ወደ ዋና ይዘት እለፍ
OpenAI

26 ጁን 2026

ምርትልቀት

GPT‑5.6 Solን በቅድመ እይታ፦ የቀጣይ ትውልድ ሞዴል

በመጫን ላይ…

የGPT‑5.6 ተከታታይን የተገደበ ቅድመ እይታ እየጀመርን ነው፦ Sol፣ የእኛ ባንዲራ ሞዴል፤ Terra፣ ለዕለታዊ ሥራ የተመጣጠነ ሞዴል፤ እና Luna፣ ፈጣንና ተመጣጣኝ ዋጋ ያለው ሞዴል። Terra ከGPT‑5.5 ጋር ተወዳዳሪ አፈጻጸም አለው፣ እንዲሁም 2x ርካሽ ነው፤ Luna ደግሞ በዝቅተኛው ወጪያችን ጠንካራ ችሎታ ያመጣል።

GPT‑5.6 Sol እስካሁን ካለን ሁሉ የበለጠ ጽኑ የደህንነት ስብስብ ጋር ይጀምራል። ለከፍተኛ አደጋ እንቅስቃሴ፣ ለስሱ የሳይበር ጥያቄዎች እና ለተደጋጋሚ አላግባብ አጠቃቀም መከላከያዎችን አጠናክረናል፤ ድክመቶችን በማግኘት፣ ሥርዓታችንን በግፊት በመፈተን እና ከእውነተኛ ዓለም ጥቃቶች ለማጠንከር ብዙ ሳምንታት አሳልፈናል።

በሰፊ መዳረሻ እናምናለን፣ እና GPT‑5.6 Sol፣ Terra እና Luna በሚመጡት ሳምንታት በአጠቃላይ እንዲገኙ እቅድ አለን። ከአሜሪካ መንግሥት ጋር ያለን ቀጣይ ተሳትፎ አካል እንደመሆኑ፣ ከዛሬው መጀመር በፊት እቅዶቻችንንና የሞዴሎቹን ችሎታዎች በቅድመ እይታ አሳይተናል። በጥያቄያቸው፣ በሰፊው ከመልቀቃችን በፊት ተሳትፎአቸው ለመንግሥት ከተጋራ አነስተኛ የታመኑ አጋሮች ቡድን ጋር የተገደበ ቅድመ እይታ እንጀምራለን። በዚህ ቅድመ እይታ ጊዜ፣ ወደ ሰፊ ተገኝነት ስንሠራ መፈተንን እና ከአጋሮች ጋር በቅርበት መቀናጀትን እንቀጥላለን። ይህ ዓይነት የመንግሥት መዳረሻ ሂደት የረጅም ጊዜ ነባሪ ሁኔታ መሆን አለበት ብለን አናምንም። ይህ ምርጥ መሣሪያዎችን ከሚፈልጉ ተጠቃሚዎች፣ ገንቢዎች፣ ድርጅቶች፣ የሳይበር ተከላካዮች እና ዓለም አቀፍ አጋሮች ያርቃል። ይህን የአጭር ጊዜ እርምጃ የምንወስደው፣ ከአስተዳደሩ ጋር የሳይበር Executive Order ማዕቀፍን እና ለወደፊት የሞዴል ልቀቶች ሊደገም የሚችል ሂደት ስናዘጋጅ፣ በሚመጡት ሳምንታት ወደ ሰፊ ተገኝነት የሚያደርስ ጠንካራው መንገድ ነው ብለን ስለምናምን ነው።

ችሎታዎች

GPT‑5.6 Sol እስካሁን ያለን ጠንካራው ሞዴል ነው። የሞዴል አፈጻጸምን ቅድመ እይታ ለመስጠት፣ በኮዲንግ፣ ባዮሎጂ እና ሳይበር ደህንነት የተሻሻሉ የወኪል-ባህሪ ችሎታዎችን የሚያጎሉ ግምገማዎችን እናጋራለን፤ ተጨማሪ የደህንነትና ዝግጁነት ግምገማዎች በ የሥርዓት ካርድ(በአዲስ መስኮት ውስጥ ይክፈታል) ውስጥ ይገኛሉ። ሞዴሉን በሰፊው ስናቀርብ፣ የተስፋፋ የግምገማ ውጤቶች ስብስብ እናጋራለን።

ከGPT‑5.6 ጋር፣ Sol በጥልቀት ለማመዛዘን ከፍተኛውን ጊዜ እንዲያገኝ አዲስ `max` የማመዛዘን ጥረት እያስተዋወቅን ነው። በተጨማሪ፣ ውስብስብ ሥራን ለማፋጠን ንዑስ-ወኪሎችን በመጠቀም ከአንድ ወኪል ችሎታዎች በላይ የሚሄድ አዲስ `ultra` ሁነታ እያስተዋወቅን ነው።

ለኮዲንግ የሥራ ፍሰቶች፣ GPT‑5.6 Sol እቅድ፣ ድግግሞሽ እና የመሣሪያ ቅንጅት የሚፈልጉ የትዕዛዝ-መስመር የሥራ ፍሰቶችን በሚፈትነው Terminal‑Bench 2.1 ላይ አዲስ ከፍተኛ ደረጃ ያስቀምጣል።

GPT‑5.6 Sol በባዮሎጂ የሥራ ፍሰቶችም ሰፊ መሻሻሎችን ያሳያል። ረጅም-አድማስ ጂኖሚክስ እና መጠናዊ-ባዮሎጂ ትንተናዎችን በሚገመግመው GeneBench v1 ላይ፣ ከGPT‑5.5 የበለጠ ጠንካራ ውጤቶችን ያገኛል፣ ያነሱ ቶክኖች እየተጠቀሙ።

GPT‑5.6 Sol ለሳይበር ደህንነት እስካሁን ያለን በጣም ችሎታ ያለው ሞዴል ነው። የተጋላጭነት ምርምር እና ብዝበዛን ጨምሮ ለረጅም-አድማስ የደህንነት ተግባሮች የአፈጻጸም-ብቃት ድንበሩን ያሸጋግራል። በExploitBench² ላይ፣ GPT‑5.6 Sol ከውጤት ቶክኖች ወደ ~1/3 ብቻ በመጠቀም ከMythos Preview ጋር ተወዳዳሪ ነው። በ ExploitGym(በአዲስ መስኮት ውስጥ ይክፈታል)3 ላይ፣ ከOpenAI እና ሌሎች ፍሮንቲየር ላቦች ጋር በመተባበር በUC Berkeley ተመራማሪዎች የተፈጠረ ቤንችማርክ፣ GPT‑5.6 Sol፣ Terra እና Luna ሞዴሎች ሁሉም ማመዛዘንን ስንጨምር በሳይበር ችሎታዎች ጠንካራ መሻሻሎችን ያሳያሉ።

ከጠንካራ መከላከያዎች ጋር ጠንካራ የሳይበር ችሎታዎች

GPT‑5.6 Sol፣ Terra እና Lunaን እስካሁን ካሉን ሁሉ የበለጠ ጽኑ መከላከያዎች ጋር፣ አወቃቀሮችንም ከእያንዳንዱ ሞዴል ችሎታ ጋር በማዛመድ አዘጋጅተናል። ሞዴሉ የበለጠ ችሎታ ሲያገኝ፣ የኮድ ግምገማ፣ የተጋላጭነት ምርምር፣ ፓች ማዘጋጀት፣ ማረም፣ የደህንነት ትምህርት እና መከላከያ ሙከራ ያሉ ሕጋዊ ሥራዎችን መዳረሻ እያስጠበቅን፣ መከላከያዎች የእውነተኛ ዓለም ተቃዋሚ ግፊትን ይበልጥ እንዲቋቋሙ እንነድፋለን። ግባችን እነዚህን ጠቃሚ አጠቃቀሞች ያለአስፈላጊነት ሳንገድብ፣ የተከለከለ የጥቃት እንቅስቃሴን ከባድ፣ እርግጠኛ ያልሆነ እና ሊታወቅ የሚችል ማድረግ ነው። በሞዴሉና በመከላከያዎቹ ላይ ባደረግነው ግምገማ መሠረት፣ የተከለከለ የጥቃት አጠቃቀምን በጉልህ እየገደብን፣ ለሕጋዊ መከላከያ ሥራ ትልቅ ጥቅም እንጠብቃለን።

GPT‑5.6 Sol ከመጀመሪያ እስከ መጨረሻ ጥቃቶችን በአስተማማኝ ሁኔታ ከማከናወን ይልቅ፣ ሰዎች ተጋላጭነቶችን እንዲያገኙና እንዲያስተካክሉ በመርዳት የተሻለ ነው። እነዚህ ችሎታዎች መሻሻላቸውን ሲቀጥሉ፣ ቅድሚያችን እነዚህ መሣሪያዎች ድክመቶችን ለማግኘት፣ ፓቾችን ለማዘጋጀት እና ሥርዓቶችን በሰፊው ለማጠናከር ሊጠቀሙባቸው ወደሚችሉ ተከላካዮች መድረሳቸውንና መጥቀማቸውን ማረጋገጥ ነው።

GPT‑5.6 Sol በ Preparedness Framework ሥር የCyber Critical ደረጃን አያልፍም። Chromium እና Firefoxን ባካተቱ ግምገማዎች ውስጥ፣ ቡጎችን እና የብዝበዛ መሠረታዊ ክፍሎችን—የብዝበዛ መገንቢያ አካላትን—ለይቶ አግኝቷል፣ ነገር ግን በተፈተኑት ሁኔታዎች ሙሉ-ሰንሰለት የሚሠራ ብዝበዛን በራሱ አላመነጨም። ቢሆንም፣ የቤንችማርክ ደረጃዎች ሞዴል ሊጠቀምበት ወይም ከሌሎች መሣሪያዎች ጋር ሊዋሃድበት የሚችል ሁሉንም መንገድ ሊይዙ አይችሉም። ያ እርግጠኝነት ማጣት፣ ከሞዴሉ ሰፊ የችሎታ ዝላይ ጋር ተያይዞ፣ የሞዴሉን የተጨመሩ ችሎታዎች ከጠንካራ መከላከያዎችና ከደረጃ በደረጃ ልቀት ጋር የምናጣምርበት ምክንያት ነው። ስለ መከላከያዎቻችን ተጨማሪ ዝርዝሮችን በ የGPT‑5.6 ቅድመ እይታ የሥርዓት ካርድ(በአዲስ መስኮት ውስጥ ይክፈታል) ውስጥ እናጋራለን።

በንብርብር የተዋቀረ የመከላከያ ስብስብ

ቆራጥ ወይም ተላማጅ አላግባብ አጠቃቀምን ለመከላከል አንድ መከላከያ ብቻ በቂ አይደለም። በGPT‑5.6 ቅድመ እይታ ሁሉ፣ ትክክለኛ አወቃቀሮች በሞዴሎች መካከል እየተለያዩ፣ በንብርብር የተዋቀሩ መከላከያዎችን እንጠቀማለን፣ እና ለእውነተኛ ዓለም ጥቃቶች በግፊት እንፈትናቸዋለን። እነዚህ በሞዴሉ ውስጥ የተሰለጠኑ መከላከያዎችን፣ በማመንጨት ጊዜ የሚደረጉ ቅጽበታዊ ፍተሻዎችን፣ የመለያ-ደረጃ ምልክቶችን፣ የተለያየ መዳረሻን፣ ክትትልን፣ ማስፈጸምን እና ቀጣይ ሙከራን ያካትታሉ።

GPT‑5.6 ተጠቃሚዎች አላማቸውን ለመሸፈን ወይም ሞዴሉን ጄልብሬክ ለማድረግ ሲሞክሩም ጨምሮ፣ የተከለከለ የሳይበር እርዳታን አልቀበልም እንዲል ተደርጎ ስልጠና ወስዷል። እነዚህ የሞዴል-ደረጃ መከላከያዎች ሞዴሉ ሊረዳበት የሚገባውና የማይገባው ነገር ዙሪያ የመጀመሪያውን ድንበር ያቆማሉ።

ቅጽበታዊ የሳይበርና ባዮሎጂ አላግባብ አጠቃቀም መደበኛ አውቂዎች ውጤት በሚመነጭበት ጊዜ በመገምገም ሌላ ንብርብር ይሰጣሉ። ለከፍተኛ አደጋ ጉዳዮች፣ ሊኖር የሚችል ጥሰት ካገኙ፣ ትልቅ የማመዛዘን ሞዴል ውይይቱንና አውዱን እስኪገመግም ድረስ ማመንጨቱ ሊቆም ይችላል። ውጤቱ የማይፈቀድ እንደሆነ ከተገመገመ፣ ወደ ተጠቃሚው ከመድረሱ በፊት ይከለከላል።

የተጠቆመ እንቅስቃሴ ከይዘት ማቆየትና ግምገማ ጋር በተያያዙ ውሎቻችንና ፖሊሲዎቻችን መሠረት፣ በተዛማጅ ውይይቶችና የአደጋ ምልክቶች ላይ የመለያ-ደረጃ ግምገማንም ሊያስነሳ ይችላል። ከአንድ ውይይት ባሻገር መመልከት፣ ተመሳሳይ ቴክኒካዊ ጽንሰ-ሐሳቦች በጣም በተለያዩ አውዶች ሊታዩ በሚችሉበት ሁኔታ፣ ሥርዓቶቻችን ቀጣይ ጎጂ ባህሪን ከሕጋዊ ሁለት-አጠቃቀም የደህንነት ሥራ እንዲለዩ ይረዳል።

እነዚህ ንብርብሮች በአንድነት፣ አጠቃላይ አቀራረቡን ከማንኛውም አንድ መከላከያ ብቻ የበለጠ ጽኑ ያደርጉታል። የሞዴል ባህሪ ጎጂ ምላሾችን የመስጠት እድል ይቀንሳል፣ ቅጽበታዊ ሥርዓቶች በማመንጨት ጊዜ ሊገቡ ይችላሉ፣ የመለያ-ደረጃ ግምገማ ሰፊ ንድፎችን ሊለይ ይችላል፣ የተለያየ መዳረሻም በነባሪ በጣም ስሱ ችሎታዎችን በሰፊው ሳያቀርብ፣ አስፈላጊ የመከላከያ ሥራን ያስጠብቃል።

በተለይ በቅድመ እይታው ጊዜ፣ ተጠቃሚዎች አንዳንድ ጥያቄዎችን የሚያግዱ ወይም የሚከለክሉ መከላከያዎች ሊያጋጥማቸው ይችላል። ሌሎች ጥያቄዎች ማመንጨቱ ለተጨማሪ ግምገማ ስለሚቆም ረዘም ሊወስዱ ይችላሉ። መከላከያዎች አንዳንድ ጊዜ በሕጋዊ ሥራ ላይ ሊገቡ ይችላሉ፣ በተለይ መከላከያና ጥቃት እንቅስቃሴ መጀመሪያ ተመሳሳይ ሊመስሉ በሚችሉባቸው ሁለት-አጠቃቀም መስኮች።

ይህ ቅድመ እይታው ለመፈተን የተነደፈው ነገር አካል ነው። መከላከያዎቹ አላግባብ አጠቃቀምን ይገድባሉ ወይስ አይገድቡም ብቻ ሳይሆን፣ ሕጋዊ ተጠቃሚዎች መደበኛ ሥራን በአስተማማኝና በብቃት መጨረስ ይችላሉ ወይስ አይችሉም መረዳት እንፈልጋለን። በቅድመ እይታው ጊዜ የሚገኝ ግብረመልስ አላስፈላጊ እገዳዎችንና መዘግየቶችን ለመቀነስ፣ መከላከያዎች አውድን የሚተረጉሙበትን መንገድ ለማሻሻል፣ እና ከሰፊ ልቀት በፊት የተለሰለሰ ተሞክሮ ለመፍጠር ይረዳናል።

የድርጅት የግላዊነት መስፈርቶችን እየደገፍን ደህንነትን ለማራመድ፣ ግላዊነትን የሚጠብቅ መለየት፣ በደንበኛ የሚንቀሳቀሱ የደህንነት መቆጣጠሪያዎች፣ እና ከደንበኛ፣ ተጠቃሚ ወይም የሥራ ጫና አደጋ ጋር የተመጣጠነ መዳረሻን ጨምሮ በረጅም ጊዜ አቀራረቦች ላይ ከድርጅት ደንበኞች ጋር እየሠራን ነው።

በራስ-ሰር ቀይ-ቡድን ሙከራ ጽናትን ማሻሻል

አጥቂዎች ዘዴያቸውን ሲያስተካክሉም መከላከያዎች ውጤታማ ሆነው መቆየት አለባቸው። በቋሚ የታወቁ ጥቃቶች ስብስብ ላይ ብቻ የሚሠራ መከላከያ ለፍሮንቲየር ሞዴል በቂ ጽናት የለውም።

ስለዚህ የራሳችንን ሞዴሎች ተጠቅመን ድክመቶችን ለማግኘትና መከላከያዎችን ፈጥነን ለማሻሻል፣ ከመቼውም በላይ ብልህነትና ኮምፒዩት ለደህንነት እየተጠቀምን ነው። በብዙ እርምጃዎች ወይም አውዶች ሊሠሩ የሚችሉ፣ በአንድ ጠባብ ሁኔታ ብቻ ያልተገደቡ አጠቃላይ የመከላከያ ማለፊያ ጥቃቶችን ለማግኘት በታለመ ራስ-ሰር ቀይ-ቡድን ሙከራ ላይ ከ700,000 በላይ A100-ተመጣጣኝ GPU ሰዓቶችን መደብን። በእነዚህ የበለጠ ከባድና አጠቃላይ ጥቃቶች ላይ ማተኮራችን መከላከያዎቹን ከቋሚ የታወቁ ውድቀቶች ስብስብ ባሻገር እንድንፈትን አስችሎናል። እንዲሁም የሰው ሙከራ ብቻ ሊሸፍነው ከሚችለው በላይ ብዙ የጥቃት ንድፎችን እንድንመረምር፣ የውድቀት ንድፎችን ቀድመን እንድንለይ፣ እና ድክመትን ከማግኘት እስከ መፍታት ያለውን መንገድ እንድናሳጥር ያስችለናል።

ከራስ-ሰር ቀይ-ቡድን ሙከራ በተጨማሪ፣ በቅድመ እይታው ጊዜ የሚቀጥል ሰፊ የሰው ባለሙያ ቀይ-ቡድን ሙከራ ለማካሄድ ከሶስተኛ ወገን ፈታኞች ጋር ሠርተናል። የሰው ቀይ-ቡድን ሙከራ ሥርዓቶቻችን ሊገምቱት በማይችሉ መንገዶች ሞዴሉን ለማሳሳት የሚሞክሩ ፈጣሪ ባለሙያዎችን በመጠቀም መከላከያዎችን በመፈተን የራስ-ሰር ሥራውን ያጠናክራል።

ማንኛውም ግምገማ ሁሉንም የምርት አወቃቀር፣ ባለብዙ ደረጃ ጥቃት ወይም የእውነተኛ ዓለም የሥራ ፍሰት ሊወክል አይችልም። ስለዚህ አዲስ የተገኙ የመከላከያ ማለፊያዎችን ለመድገም፣ ለመገምገም፣ ቅድሚያ ለመስጠትና ለማስተካከል ፈጣን ምላሽ ሂደት እንይዛለን፤ ከዚያም ወደ ቀጣይ ግምገማዎቻችን እንጨምራቸዋለን፣ በወደፊት ተመሳሳይ ውድቀቶችን ለመፈተን እንድንችል።

ተገኝነትና ዋጋ

በቅድመ እይታው ጊዜ፣ GPT‑5.6 ሞዴሎች መጀመሪያ በAPI እና Codex በኩል ለተመረጡ የታመኑ አጋሮችና ድርጅቶች ይገኛሉ። በቅርቡ ChatGPT፣ Codex እና API ለሚጠቀሙ ሰዎች በሰፊው እንዲገኙ እቅድ አለን።

ከGPT‑5.6 ጋር በተ introduced በዚህ አዲስ የስያሜ ሥርዓት፣ ቁጥሩ የሞዴሉን ትውልድ ይጠቁማል፤ Sol፣ Terra እና Luna ግን በራሳቸው ፍጥነት ሊራመዱ የሚችሉ ዘላቂ የችሎታ ደረጃዎችን ይጠቁማሉ። ቤተሰቡ በአንድነት ለሰዎችና ለገንቢዎች በብልህነት፣ ፍጥነት እና ወጪ መካከል የተሻለ ግልጽ ምርጫ ይሰጣል።

GPT‑5.6 በሶስት የሞዴል መጠኖች በ1M ቶክኖች ዋጋ ተደርጎበታል፦ Sol $5 ግቤት / $30 ውጤት፤ Terra $2.50 ግቤት / $15 ውጤት፤ Luna $1 ግቤት / $6 ውጤት። GPT‑5.6 የግልጽ ካሽ መቆሚያ ነጥቦችን እና የ30 ደቂቃ ዝቅተኛ የካሽ ዕድሜን ጨምሮ፣ የበለጠ ሊገመት የሚችል የእርምጃ ካሺንግ ያስተዋውቃል። ለGPT‑5.6 እና ከዚያ በኋላ ሞዴሎች፣ የካሽ ጽሑፎች ካልተካሸ የሞዴሉ የግቤት ተመን 1.25x ይከፈላሉ፤ የካሽ ንባቦች ግን የ90% የተካሸ-ግቤት ቅናሽ መቀበላቸውን ይቀጥላሉ።

በጁላይ ላይ GPT‑5.6 Solን በCerebras ላይ እስከ 750 ቶክኖች በሰከንድ ፍጥነት እየጀመርን ነው፣ ይህም ፍሮንቲየር ብልህነትን ለደንበኞች በከዚህ በፊት ባልታየ ፍጥነት ያመጣል። አቅምን ስናስፋ፣ መዳረሻው መጀመሪያ ለተመረጡ ደንበኞች ብቻ ይገደባል።

ከዚህ የቅድመ እይታ ጊዜ መማራችንን ለመቀጠል፣ እና GPT‑5.6 Sol፣ Terra እና Lunaን በቅርቡ ለብዙ ሰዎች ለማቅረብ በጉጉት እንጠባበቃለን።


1. የመዘግየትና የAPI ወጪ ግምቶቻችንን የሞዴሎቻችንን የምርት ባህሪ በመመልከትና ከመስመር ውጭ በመምሰል እናዘጋጃለን። እነዚህ ግምቶች የመሣሪያ ጥሪ ዝርዝሮችን፣ ናሙና ቶክኖችን እና የግቤት ቶክኖችን ያካትታሉ። የእውነተኛ ዓለም ውጤቶች በእጅጉ ሊለያዩ ይችላሉ፣ እና በምስሌያችን ያልተያዙ ብዙ ምክንያቶች ላይ ይመሰረታሉ። መዘግየትን በፈጣን API ፍጥነቶች፣ ወጪን ደግሞ በመደበኛ API ዋጋ እንመስላለን።

2. ሁሉም ሞዴሎች 5 seeds እና የማመዛዘን ቀጣይነት ያለውን ExploitBench API harness በመጠቀም ይገመገማሉ።

3. ExploitGymን በalpha APIያችን ላይ አስኬደነዋል፤ ይህ ከሕዝባዊ APIያችን ይልቅ ምላሾችን ፈጥኖ ያወጣል፣ ከዚያም ከሕዝባዊ APIያችን ጋር እንዲዛመድ እንደገና መጠን ሰጥተናል። መዘግየቶችን ለሕዝባዊ APIያችን የሚጠበቁ ፍጥነቶች ስናስተካክል፣ በግምገማ ሙከራው በትክክል ቢከበሩም አንዳንድ የተገመቱ መዘግየቶች የ2 ሰዓትና 6 ሰዓት የጊዜ ገደቦችን እንዲያልፉ ያደርጋል። ለጊዜ-አስፈላጊ ሥራ ፈጣን ፍጥነት ለማግኘት፣ በAPI ውስጥ priority processing እና በCodex ውስጥ fast mode እናቀርባለን።

4. የውጤት ቶክኖች፣ መዘግየት ወይም ወጪ ያልተዘገበላቸው ሞዴሎች እንደ አግድም ነጥብ መስመሮች ተስለዋል።

ደራሲ

OpenAI