အဓိက အကြောင်းအရာသို့ ကျော်သွားရန်
OpenAI

GPT-6.1Sol

ဈေးနှုန်း ငါးပုံတစ်ပုံဖြင့် Astra နီးပါး ဉာဏ်ရည်ကို ရယူကာ စွမ်းဆောင်ရည်အမြင့်ဆုံး အဆင့်ကို ဆက်လက်ထိန်းသိမ်းပါ

agentic coding၊ ကွန်ပျူတာအသုံးပြုမှုနှင့် ပညာရှင်လုပ်ငန်းများတွင် ထူးခြားစွာ စွမ်းဆောင်နိုင်သည့် GPT‑6 Sol ၏ အဆင့်မြှင့်ဗားရှင်း GPT‑6.1 Sol ကို မိတ်ဆက်လိုက်ပါသည်။ ခက်ခဲသော အလုပ်များတွင် Sol ကို GPT‑6 Astra နှင့် ပိုနီးစပ်လာစေပြီး Astra ၏ ပုံမှန် အဝင်နှင့် အထွက်တိုကင်ဈေး ငါးပုံတစ်ပုံသာ ကျသင့်သည်။ ထို့ကြောင့် ဆော့ဖ်ဝဲရေးသားသူများသည် ဘတ်ဂျက်မတိုးဘဲ စွမ်းရည်မြင့် အေးဂျင့်များကို ပိုမိုဖန်တီး အသုံးပြုနိုင်သည်။

GPT‑6.1 Sol သည် Sol ဈေးနှုန်းဖြင့် Astra နီးပါး စွမ်းဆောင်ရည်ကို ပေးစွမ်းသဖြင့် ယနေ့ရရှိနိုင်သည့် မော်ဒယ်များထဲတွင် ၎င်း၏စွမ်းဆောင်ရည်အတွက် ကုန်ကျစရိတ် အထိရောက်ဆုံးဖြစ်သည်။ ကက်ရှ်သိမ်းထားသော အဝင်တိုကင် တစ်သန်းလျှင် $0.10 သာ ကျသင့်ပြီး ပုံမှန်အဝင်ဈေးထက် 95% သက်သာသည်။ ထို့ကြောင့် ထပ်ခါတလဲလဲ တောင်းဆိုမှုများတွင် နောက်ခံအချက်အလက်ကို ပြန်သုံးရသည့် အေးဂျင့်အလုပ်များအတွက် ပိုမိုသက်သာစေသည်။

GPT‑6 Astra သည် စွမ်းဆောင်ရည်အမြင့်ဆုံး မော်ဒယ်များထဲတွင် ကျွန်ုပ်တို့၏ အလုံးစုံစွမ်းရည်အကောင်းဆုံးအဖြစ် ဆက်ရှိနေသည်။ GPT‑6.1 Sol သည် အရေးကြီးအလုပ်များကို ပိုမိုမကြာခဏ လုပ်ဆောင်လိုသူများနှင့် အက်ပ်များကို အကြီးစား ဖန်တီးအသုံးပြုနေသည့် API သုံးစွဲသူများအတွက် စွမ်းရည်နှင့် ကုန်ကျစရိတ် ဟန်ချက်အသစ်ကို ပေးစွမ်းသည်။

မော်ဒယ်ကတ် သုံးခု—GPT-6 Astra၊ အကောင်းဆုံးရလဒ်များအတွက် ကျွန်ုပ်တို့၏ ဉာဏ်ရည်အမြင့်ဆုံး မော်ဒယ်၊ အဝင် $10၊ အထွက် $50၊ ကက်ရှ်သိမ်းထားသော အဝင် $1။ GPT-6.1 Sol၊ ဈေးနှုန်း ငါးပုံတစ်ပုံဖြင့် Astra နီးပါး ဉာဏ်ရည်၊ အဝင် $2၊ အထွက် $10၊ ကက်ရှ်သိမ်းထားသော အဝင် $0.10။ GPT-6 Luna၊ နေ့စဉ်အလုပ်များကို ပမာဏများများ မြန်ဆန်ထိရောက်စွာ လုပ်ဆောင်ရန်၊ အဝင် $0.10၊ အထွက် $0.50၊ ကက်ရှ်သိမ်းထားသော အဝင် $0.01။

အလုပ်မျိုးစုံတွင် ပိုမိုစွမ်းဆောင်နိုင်သော Sol

ကုဒ်ရေးခြင်း၊ အမှားပြင်ခြင်းမှ စာရွက်စာတမ်း နားလည်ခြင်း၊ အဆင့်ဆင့်ပါသော လုပ်ငန်းစဉ်များ ဆောင်ရွက်ခြင်းအထိ ရှုပ်ထွေးသော ပညာရှင်အလုပ်များတွင် GPT‑6.1 Sol သည် GPT‑6 Sol ထက် သိသိသာသာ တိုးတက်လာသည်။ ဤအကဲဖြတ်မှု အများအပြားတွင် ကုန်ကျစရိတ် သိသိသာသာ နည်းပါးစွာဖြင့် GPT‑6 Astra ၏ စွမ်းဆောင်ရည်ကို ချဉ်းကပ်လာသည်။

ကုဒ်ရေးသားခြင်း

လက်တွေ့ကုဒ်အစုများရှိ ရှုပ်ထွေးသော ဆော့ဖ်ဝဲအင်ဂျင်နီယာအလုပ်များကို အကဲဖြတ်သည့် DeepSWE v1.1 တွင် GPT‑6.1 Sol သည် ကုန်ကျစရိတ် ငါးပုံတစ်ပုံခန့်ဖြင့် GPT‑6 Astra ကို မီသည်။ ထို့ပြင် ကျိုးကြောင်းသင့်လျော်စွာ စဉ််းစားပေးသော အားထုတ်မှုနှင့် ကုန်ကျစရိတ် ပိုနည်းလျက် GPT‑6 Sol ၏ အကောင်းဆုံးရမှတ်ထက် 6.4 ရာခိုင်နှုန်းပွိုင့် သာလွန်သည်။

DeepSWE 1.1⁠⁠(ဝင်းဒိုးအသစ်တွင် ဖွင့်မည်) တွင် AI အေးဂျင့်များသည် ရေရှည်ဆောင်ရွက်ရသော မူရင်းဆော့ဖ်ဝဲအင်ဂျင်နီယာ လုပ်ငန်းတာဝန်များကို ဖြေရှင်းကြသည်။

ပညာရှင်လုပ်ငန်းများ

GDP.pdf သည် ဇယား၊ ဂရပ်၊ ပုံကြမ်းနှင့် စာလုံးသေးအသေးစိတ်များပါသော ရှုပ်ထွေးသည့် PDF များကို သုံး၍ မော်ဒယ်များက ပညာရပ်ဆိုင်ရာမေးခွန်းများကို မည်မျှမှန်ကန်စွာ ဖြေနိုင်ကြောင်း တိုင်းတာသည်။ စမ်းသပ်ထားသည့် ကျိုးကြောင်းသင့်လျော်စွာ စဉ််းစားပေးသော ဆက်တင်များတွင် GPT‑6.1 Sol သည် အရန်နည်းလမ်းများပါသော Opus 5.5 ထက် ရမှတ်ပိုမြင့်ပြီး အလုပ်တစ်ခုလျှင် ကုန်ကျစရိတ် တစ်ဝက်အောက်သာ ရှိသည်။ အလုပ်တစ်ခုလျှင် ကုန်ကျစရိတ် ငါးပုံတစ်ပုံခန့်ဖြင့် GPT‑6 Astra ၏ ထိပ်တန်းစွမ်းဆောင်ရည်ကိုလည်း ချဉ်းကပ်လာသည်။

GDP.pdf⁠(ဝင်းဒိုးအသစ်တွင် ဖွင့်မည်) တွင် မော်ဒယ်များသည် ဘဏ္ဍာရေး၊ ကျန်းမာရေးစောင့်ရှောက်မှု၊ ဥပဒေနှင့် အခြားအသက်မွေးဝမ်းကျောင်းနယ်ပယ် ခုနစ်ခုရှိ လုပ်ငန်းစဉ်များမှ ရယူထားသော ရှုပ်ထွေးသည့် PDF များနှင့်ပတ်သက်သည့် လက်တွေ့ဘဝ မေးခွန်းနှင့် ညွှန်ကြားချက်များကို ဖြေဆိုရသည်။

အေးဂျင့်များက အဆင့်ဆင့်ပါသော လုပ်ငန်းစဉ်များကို မှန်ကန်စွာ ပြီးမြောက်ခြင်းရှိမရှိ တိုင်းတာသည့် AutomationBench တွင် GPT‑6.1 Sol သည် ကျိုးကြောင်းသင့်လျော်စွာ စဉ််းစားပေးသော အားထုတ်မှု အလယ်အလတ်အဆင့်၌ Opus 5.5 ထက် 2.2 ရာခိုင်နှုန်းပွိုင့် သာလွန်ပြီး ကုန်ကျစရိတ် သုံးပုံတစ်ပုံခန့်သာ ရှိသည်။ ထိုရမှတ်သည် ဆက်တင်တူ GPT‑6 Sol ထက်လည်း 4.8 ရာခိုင်နှုန်းပွိုင့် ပိုမြင့်သည်။

In AutomationBench 1.0.6⁠⁠(ဝင်းဒိုးအသစ်တွင် ဖွင့်မည်), AI agents are tested on end-to-end workflows using 47 tools across sales, marketing, operations, support, finance, and HR. The datapoint for Claude Fable 5.1 understates its actual cost, as it omits the cost of fallbacks, which occurred on ~40% of tasks.

ကွန်ပျူတာအသုံးပြုခြင်း

ကွန်ပျူတာအက်ပ်များနှင့် အပြန်အလှန် လုပ်ဆောင်ရသည့် အလုပ်များတွင်လည်း GPT‑6.1 Sol သည် သိသိသာသာ တိုးတက်လာသည်။ ခက်ခဲသော ကွန်ပျူတာသုံး လုပ်ငန်းစဉ်များဖြင့် အေးဂျင့်များကို အကဲဖြတ်သည့် OSWorld 2.0 ၏ အော့ဖ်လိုင်း စမ်းသပ်အစုတွင် GPT‑6.1 Sol သည် ကျိုးကြောင်းသင့်လျော်စွာ စဉ််းစားပေးသော အားထုတ်မှု အမြင့်ဆုံးအဆင့်၌ GPT‑6 Sol ထက် 7 ရာခိုင်နှုန်းပွိုင့် သာလွန်ပြီး ကုန်ကျစရိတ် တစ်ဝက်အောက်သာ ရှိသည်။ ကျိုးကြောင်းသင့်လျော်စွာ စဉ််းစားပေးသော အားထုတ်မှု အမြင့်ဆုံးအဆင့်၌ Astra ၏ ရမှတ်နှင့် 2.1 ရာခိုင်နှုန်းပွိုင့်သာ ကွာပြီး အလုပ်တစ်ခုလျှင် ကုန်ကျစရိတ် ခုနစ်ပုံတစ်ပုံခန့်သာ ရှိသည်။

In OSWorld 2.0⁠⁠(ဝင်းဒိုးအသစ်တွင် ဖွင့်မည်), AI agents attempt long-horizon computer-use workflows spanning everyday and professional tasks. We report the partial reward on the offline set from the v2026.08.08 release.

သိပ္ပံသုတေသန

ဒေတာခွဲခြမ်းစိတ်ဖြာခြင်း၊ သရုပ်တူစမ်းသပ်ခြင်းနှင့် သီအိုရမ်သက်သေပြခြင်းတို့ပါဝင်သော သိပ္ပံလုပ်ငန်းစဉ်များကို အကဲဖြတ်သည့် Terminal-Bench Science 0.1 တွင် GPT‑6.1 Sol သည် ကျိုးကြောင်းသင့်လျော်စွာ စဉ််းစားပေးသော အားထုတ်မှု အမြင့်ဆုံးအဆင့်၌ GPT‑6 Sol ၏ ရမှတ်ထက် နှစ်ဆကျော် ရရှိပြီး အလုပ်တစ်ခုလျှင် ကုန်ကျစရိတ် တစ်ဝက်အောက်သာ ရှိသည်။ အားထုတ်မှု အမြင့်ဆုံးအဆင့်၌ အလုပ်တစ်ခုလျှင် ပျမ်းမျှကုန်ကျစရိတ်မှာ GPT‑6.1 Sol အတွက် $5.47၊ Opus 5.5 အတွက် $23.21 နှင့် Astra အတွက် $23.80 ဖြစ်သည်။ မော်ဒယ်နှစ်ခုစလုံးထက် 75% ကျော် သက်သာစွာဖြင့် သိပ္ပံဆိုင်ရာ စွမ်းရည်မြင့်မားမှုကို ပေးစွမ်းသည်။

GPT‑6 Astra သည် စမ်းသပ်ထားသော မော်ဒယ်များအနက် အမြင့်ဆုံးရမှတ် 68.1% ကို ဆက်လက်ရရှိထားပြီး အခက်ခဲဆုံး သိပ္ပံသုတေသနအလုပ်များအတွက် အသုံးပြုသင့်သည်။

Terminal-Bench Science 0.1⁠(ဝင်းဒိုးအသစ်တွင် ဖွင့်မည်) တွင် အေးဂျင့်များသည် ကုဒ်နှင့် terminal ကိရိယာများကို အသုံးပြုကာ ဒေတာခွဲခြမ်းစိတ်ဖြာခြင်း၊ သရုပ်တူစမ်းသပ်မှုများ လုပ်ဆောင်ခြင်းနှင့် မော်ဒယ်များကို ဒေတာနှင့် ကိုက်ညီအောင် ချိန်ညှိခြင်းတို့အပါအဝင် သိပ္ပံသုတေသန လုပ်ငန်းစဉ်များကို ပြီးမြောက်အောင် ဆောင်ရွက်ကြသည်။

အချက်အလက်မှန်ကန်မှု

ခက်ခဲသော ညွှန်ကြားချက်များအတွက်လည်း GPT‑6.1 Sol ၏ အချက်အလက်မှန်ကန်မှု ပိုကောင်းလာသည်။ ကျိုးကြောင်းသင့်လျော်စွာ စဉ််းစားပေးသော အားထုတ်မှု အလွန်မြင့်အဆင့်၌ ၎င်း၏ အချက်အလက်အမှားနှုန်းမှာ 4.1% ဖြစ်သည်။ GPT‑6 Sol ၏ 4.5% ထက် လျော့နည်းကာ ဆက်တင်တူ Astra ၏ 4.0% နှင့် ပိုနီးစပ်လာပြီး အလုပ်တစ်ခုလျှင် Astra ထက် 83% ခန့် သက်သာသည်။

ဤအကဲဖြတ်မှုတွင် ယခင်မော်ဒယ်၏ အမှားကို အသုံးပြုသူများ အမှတ်အသားပြုထားသည့် စကားဝိုင်းများမှ ကိုယ်ရေးအချက်အလက်များ ဖယ်ရှားပြီး အချက်အလက်အမှား အနည်းဆုံးတစ်ခု ပါသော အဖြေအချိုးကို တိုင်းတာသည်။ တမင်ရွေးချယ်ထားသော ဤခက်ခဲသည့် ညွှန်ကြားချက်များသည် ပုံမှန်အသုံးပြုမှုကို ကိုယ်စားမပြုပါ။

ယခင်မော်ဒယ်၏ အချက်အလက်အမှားကို အသုံးပြုသူများက အမှတ်အသားပြုထားသည့် ChatGPT စကားဝိုင်းများမှ ကိုယ်ရေးအချက်အလက်များ ဖယ်ရှားပြီး အချက်အလက်မှန်ကန်မှုကို အကဲဖြတ်ပါသည်။ အမှားဖြစ်စေတတ်သော ဤစကားဝိုင်းများသည် အချက်အလက်အမှား ပိုမိုရှားပါးသော ပုံမှန်အသုံးပြုမှုကို ကိုယ်စားမပြုပါ။

GPT‑6.1 Sol ကို ဘေးကင်းစွာ အသုံးပြုနိုင်ရန်

လူ့ရည်ရွယ်ချက်များနှင့် ကိုက်ညီမှုဆိုင်ရာ ကျွန်ုပ်တို့၏ အကဲဖြတ်မှုများတွင် GPT‑6.1 Sol သည် GPT‑6 Sol ထက် သိသိသာသာ တိုးတက်လာပြီး GPT‑6 Astra နှင့် ပိုနီးစပ်လာသည်။

GPT‑6.1 Sol သည် ၎င်း၏ အကန့်အသတ်များကို ပိုမိုပွင့်လင်းစွာ အသိပေးပြီး အသုံးပြုသူ၏ ရည်ရွယ်ချက်နှင့် ဘေးကင်းရေးကန့်သတ်ချက်များကို ပိုမိုယုံကြည်စိတ်ချစွာ လိုက်နာသည်။ ခက်ခဲသော အကဲဖြတ်မှုများတွင် ရှာဖွေရေးကိရိယာ အလုပ်မလုပ်ကြောင်း အသိပေးခြင်း၊ ရှင်းလင်းသော ကန့်သတ်ချက်များကို လိုက်နာခြင်းနှင့် အေးဂျင့်အလုပ်များတွင် ခွင့်မပြုထားသော ရလဒ်များကို ရှောင်ခြင်းတို့၌ GPT‑6 Sol ထက် ပျက်ကွက်မှုနှုန်း နည်းသည်။ GPT‑6 Astra နှင့် GPT‑6 Sol တို့ကဲ့သို့ပင် အလိုအလျောက် ဘေးကင်းရေးစစ်ဆေးသည့်စနစ်ကို ကျော်လွှားရန် ကြိုးပမ်းမှု မတွေ့ရပါ။

အောက်ပါအကဲဖြတ်မှုများသည် ခက်ခဲသော အခြေအနေများကို တမင်စမ်းသပ်ခြင်းဖြစ်ပြီး ပုံမှန်အသုံးပြုမှု၏ ပျက်ကွက်မှုနှုန်းကို တိုင်းတာခြင်း မဟုတ်ပါ။

ဈေးနှုန်းနှင့် ရရှိနိုင်မှု

ယနေ့မှစ၍ Plus၊ Pro၊ Business၊ Enterprise နှင့် Edu အသုံးပြုသူအားလုံးသည် ChatGPT အလုပ် နှင့် Codex တွင် GPT‑6.1 Sol ကို အသုံးပြုနိုင်ပါပြီ။ ဤမော်ဒယ်များကို စကားပြော တွင် မရရှိသေးပါ။ ဆော့ဖ်ဝဲရေးသားသူများသည် OpenAI API မှတစ်ဆင့် gpt-6.1-sol အဖြစ်လည်း အသုံးပြုနိုင်သည်။ ပုံမှန် API ဈေးနှုန်းမှာ အဝင်တိုကင် တစ်သန်းလျှင် $2၊ ကက်ရှ်သိမ်းထားသော အဝင်တိုကင် တစ်သန်းလျှင် $0.10 နှင့် အထွက်တိုကင် တစ်သန်းလျှင် $10 ဖြစ်သည်။

တစ်ချိန်တည်းတွင် GPT‑6 Astra ထက် 8 ဆအထိ ပိုမြန်သော၊ စွမ်းဆောင်ရည်အမြင့်ဆုံး မော်ဒယ်များအနက် ကမ္ဘာ့အမြန်ဆုံးဖြစ်သည့် GPT‑6 Astra Ultrafast နှင့် GPT‑6.1 Sol Ultrafast ကိုလည်း မိတ်ဆက်လိုက်ပါသည်။ ၎င်းတို့ကို API တွင် ရရှိနိုင်သလို တစ်လ $500 ဖြင့် အသုံးပြုခွင့်အများဆုံးပေးသည့် Pro အဆင့်အသစ်မှ အသုံးပြုသူများအတွက် ChatGPT အလုပ် နှင့် Codex တွင်လည်း ရရှိနိုင်သည်။ GPT‑6.1 Sol Ultrafast ဖြင့် ဆော့ဖ်ဝဲရေးသားသူများသည် ယခင် GPT‑6 Astra ၏ API ကုန်ကျစရိတ်နီးပါးဖြင့် Astra နီးပါး ဉာဏ်ရည်နှင့် 8 ဆအထိ မြန်နှုန်းကို ရရှိနိုင်သည်။

စာရေးသူများ

OpenAI

Evaluations of GPT were performed in our research environment or via our API, which may provide slightly different output from production ChatGPT due to differences in the system prompts, tools available, efforts, etc. Evaluations of competitor models were taken from publicly available reports.