ప్రధాన కంటెంట్‌కి దాటండి
OpenAI

4 ఆగస్టు, 2026

సెక్యూరిటీ

OpenAI మోడళ్లతో మూడో పక్ష సైబర్ మూల్యాంకనాలు

లోడ్ అవుతోంది…

అమలుకు ముందు ప్రమాదాలను ధ్రువీకరించడానికి, మరింత మెరుగ్గా అర్థం చేసుకోవడానికి స్వతంత్ర పరీక్షలు మాకు కీలకంగా తోడ్పడతాయి. కొన్ని సైబర్ మూల్యాంకనాల్లో అంతర్లీన సామర్థ్యాన్ని కొలవడానికి రక్షణ చర్యలను తగ్గించడం సహా ఉద్దేశపూర్వకంగా ప్రత్యేక కాన్ఫిగరేషన్‌లను ఉపయోగిస్తారు. పబ్లిక్‌గా అందుబాటులో ఉన్న అమలుల్లో మోడళ్లు సాధారణంగా ఎలా ప్రవర్తిస్తాయో కొలవడం వాటి ఉద్దేశం కాదు.

ఇటీవలి మూల్యాంకనాల్లో, పరీక్ష కాన్ఫిగరేషన్‌లు, నియంత్రణలు, తాజా మోడళ్ల అభివృద్ధి చెందిన సామర్థ్యాలు కలిసి మోడల్ కార్యకలాపాలు ఉద్దేశించిన పరీక్ష హద్దులను దాటేందుకు వీలు కల్పించిన ఘటనలను ఇద్దరు బాహ్య పరీక్ష భాగస్వాములు గుర్తించారు. మోడళ్ల సామర్థ్యాలు పెరుగుతున్న కొద్దీ పరీక్ష వాతావరణాలు, పద్ధతులకు సంబంధించిన ప్రమాణాలను మెరుగుపరచడానికి పరిశ్రమలోని సంస్థలు, మూడో పక్ష మూల్యాంకనకర్తలు కలిసి పనిచేయాల్సిన ప్రాధాన్యాన్ని ఈ ఘటనలు స్పష్టం చేస్తున్నాయి. సంపాదకుని గమనిక: ఇవి Hugging Face భద్రతా ఘటనకు భిన్నమైనవి. Hugging Face ఘటనకు సంబంధించిన తాజా సమాచారాన్ని మేము ఇక్కడ పంచుకుంటూనే ఉంటాం.

సాధారణ అమలును ప్రతిబింబించని నిర్దిష్ట పరిస్థితులు, తగ్గించిన రక్షణ చర్యల కాన్ఫిగరేషన్‌లలో మూడో పక్ష సైబర్ మూల్యాంకనాల సమయంలో OpenAI మోడళ్లు పబ్లిక్ ఇంటర్నెట్‌ను యాక్సెస్ చేయడం ఈ కొత్త ఘటనల్లో చోటుచేసుకుంది. ఆ ఘటనలు ఇవి:

  1. ఏజెంట్లు తమకు అవసరమైన సాధనాలను స్వయంగా కనుగొని, నిజమైన దాడిదారుడికి దగ్గరైన పరిస్థితుల్లో పనిచేసేందుకు వీలుగా ఇంటర్నెట్ సదుపాయాన్ని ఉద్దేశపూర్వకంగా ప్రారంభించి, అంతర్లీన సామర్థ్యాన్ని కొలిచేందుకు సైబర్ వర్గీకరణ వ్యవస్థలను నిలిపివేసి UK ప్రభుత్వ AI భద్రతా సంస్థ UK AISI సైబర్ పరిధి మూల్యాంకనాలను నిర్వహించింది. వారి బ్లాగును ఇక్కడ చదవవచ్చు.(కొత్త విండోలో తెరుచుకుంటుంది)
  2. మా బాహ్య సైబర్ భద్రతా పరీక్ష భాగస్వాముల్లో ఒకటైన ఇరెగ్యులర్, ఇంటర్నెట్ నుంచి వేరుగా ఉండేలా ఉద్దేశించిన క్యాప్చర్-ది-ఫ్లాగ్ తరహా మూల్యాంకనాలను నిర్వహించింది. అయితే, పరీక్ష వాతావరణంలోని తప్పు కాన్ఫిగరేషన్ వల్ల మోడళ్లు పబ్లిక్ ఇంటర్నెట్‌ను యాక్సెస్ చేయగలిగాయి.

ఏం జరిగింది, ఈ కార్యకలాపానికి వీలు కల్పించిన పరీక్ష పరిస్థితులు, దాన్ని అదుపు చేయడానికి తీసుకున్న చర్యలు, పెరుగుతున్న సామర్థ్యాలున్న మోడళ్లను స్వతంత్ర ల్యాబ్‌లు క్షుణ్ణంగా, సురక్షితంగా మూల్యాంకనం చేస్తూనే ఉండేలా మేము చేపడుతున్న చర్యలను కింద సంగ్రహించాం.

మూడో పక్ష మోడల్ మూల్యాంకన వాతావరణాల పటిష్ఠీకరణ

Hugging Face ఘటన గురించి ఇటీవలి పోస్ట్‌లో మేము వివరించిన విస్తృత సవాలునే ఈ ఘటనలు సూచిస్తున్నాయి. మోడళ్ల సామర్థ్యాలు అభివృద్ధి చెందుతున్న కొద్దీ వాటి చుట్టూ ఉన్న భద్రతా వ్యవస్థలు కూడా అభివృద్ధి చెందాలి. ఇందులో మోడళ్లను అభివృద్ధి చేయడానికి ఉపయోగించే వాతావరణాలతో పాటు, ల్యాబ్‌లు, స్వతంత్ర భాగస్వాములు వాటిని మూల్యాంకనం చేయడానికి ఉపయోగించే వాతావరణాలు కూడా ఉన్నాయి.

రాబోయే వారాల్లో మూడో పక్ష పరీక్షలపై మా విధానాన్ని సమీక్షిస్తాం. హై ప్రమాదం గల మూల్యాంకనాలను గుర్తించడం, పరిధిపై అంగీకరించడం, ఇంటర్నెట్ సదుపాయం లేదా తగ్గించిన రక్షణ చర్యల అభ్యర్థనలను అంచనా వేయడం, వేరుచేయడం, ఆధారాల నిర్వహణ, పర్యవేక్షణ, నిలిపివేత షరతులపై అంచనాలను నిర్దేశించడం, ఘటనల నివేదన, తీవ్రత పెంపు ప్రక్రియలను మరింత స్పష్టం చేయడం ఇందులో భాగం.

అధిక ప్రమాదం గల మూల్యాంకనాలను సురక్షితంగా నిర్వహించడానికి ఉమ్మడి పద్ధతులను బలోపేతం చేసేందుకు పరిశ్రమ అంతటా కలిసి పనిచేయడానికి మేము కట్టుబడి ఉన్నాం. ఇందులో భాగంగా రాబోయే వారాల్లో జాతీయ AI సంస్థలు, స్వతంత్ర మూల్యాంకనకర్తలు, ఇతర AI ల్యాబ్‌లు, ఇతర బృందాల వంటి భాగస్వాములను సమావేశపరుస్తాం. పరీక్ష పద్ధతులు పెరుగుతున్న మోడళ్ల సామర్థ్యాలకు అనుగుణంగా ఉండేలా చూస్తూనే, కఠినమైన స్వతంత్ర మూల్యాంకనం అందించే విలువను కాపాడటం మా లక్ష్యం.

UK AISI

జూలై 25న ప్రారంభమైన సాధారణ సైబర్ మూల్యాంకనంలో OpenAI, మరో ల్యాబ్‌కు చెందిన మోడళ్లు కొన్ని సందర్భాల్లో పరీక్ష పరిధిని దాటాయని ఆగస్టు 3న UK AISI మాకు తెలిపింది. వాస్తవ ప్రపంచ నెట్‌వర్క్‌లను అనుకరించేలా రూపొందించిన నియంత్రిత సైబర్ పరిధుల్లో ఈ మూల్యాంకనం జరిగింది. గుర్తించిన 19 ఘటనల్లో రెండింటిలో OpenAI మోడల్ GPT‑5.6 Sol ప్రమేయం ఉంది. మిగతా సందర్భాల్లో మరో ల్యాబ్‌కు చెందిన మోడళ్లు ఉన్నాయి.

ఈ మూల్యాంకనంలో క్యాప్చర్-ది-ఫ్లాగ్ వ్యాయామంలో సైబర్ భద్రతా నిపుణులుగా వ్యవహరించాలని ఏజెంట్లకు సూచించారు. అనుసంధానమైన మూడు అనుకరణ వాతావరణాలను ఛేదించి, చివరి ఫ్లాగ్‌ను పొందడం వాటి పని. పని ప్రాంప్ట్ పరిధిలోని నెట్‌వర్క్‌లను గుర్తించి, అనేక సిస్టమ్‌లు పరిధికి వెలుపల ఉన్నాయని పేర్కొంది. ఏజెంట్లు సాధనాలను డౌన్‌లోడ్ చేసుకొని, మానవ దాడిదారుడికి దగ్గరైన పరిస్థితుల్లో పనిచేసేందుకు UK AISI ప్రత్యక్ష ఇంటర్నెట్ సదుపాయాన్ని కూడా ప్రారంభించింది. అంతర్లీన సామర్థ్యాన్ని కొలవడానికి మోడల్ సైబర్ వర్గీకరణ వ్యవస్థలను నిలిపివేసింది.

UK AISI ఉద్దేశించిన అనుమతి హద్దు అనుకరణ సైబర్ పరిధి వరకే. పేర్కొన్న అనుకరణ నెట్‌వర్క్‌లపై దాడి చేసి ఫ్లాగ్‌ను పొందడానికి ఏజెంట్లకు అనుమతి ఉంది కానీ పరిధి నెట్‌వర్క్ హద్దు వెలుపలి సిస్టమ్‌లతో పరస్పర చర్యకు అనుమతి లేదు. అయితే, బహిరంగ ఇంటర్నెట్ సదుపాయాన్ని ఎలా ఉపయోగించవచ్చు, ఎలా ఉపయోగించకూడదు అనే విషయాలను ఏజెంట్లకు స్పష్టంగా చెప్పలేదు. ఇది ఘటనకు దోహదపడిన సంభావ్య కారణమని UK AISI గుర్తించింది.

ఈ ప్రయోగాల్లో, అనుకరణ పరిధిలోకి ప్రవేశించే మార్గాన్ని కనుగొని ఫ్లాగ్‌ను పొందడానికి ప్రయత్నిస్తున్నప్పుడు GPT‑5.6 Sol అనుమతి లేని రెండు చర్యలు చేపట్టిందని UK AISI గుర్తించింది:

  1. మరో ల్యాబ్‌కు చెందిన ఏజెంట్ బహిరంగంగా అందుబాటులో ఉంచిన GitHub టోకెన్‌ను GPT‑5.6 Sol మళ్లీ ఉపయోగించింది. పరిధిలోని ఒక సిస్టమ్ GitHub లేదా మరో నవీకరణ సేవను సంప్రదిస్తోందో లేదో తనిఖీ చేసింది, ఖాతా పునరుద్ధరణ మరియు అభ్యర్థన పరిమితులను దాటేందుకు ప్రయత్నించింది, అలాగే బాహ్య డీఎన్ఎస్, టన్నెలింగ్ సేవా సంస్థల వద్ద ఖాతాలను నమోదు చేసింది.
  2. తన మూల్యాంకన వాతావరణంలో స్థానికంగా నడుస్తున్న డీఎన్ఎస్ సర్వర్‌ను పబ్లిక్ ఇంటర్నెట్ నుంచి చేరుకోగలిగేలా చేయడానికి GPT‑5.6 Sol ఒక పబ్లిక్ టన్నెలింగ్ సేవను ఉపయోగించింది. పరీక్ష పరిధిలో నడుస్తున్న ఒక సాఫ్ట్‌వేర్‌లోని తెలిసిన బలహీనత లక్ష్యంగా చేసుకున్న పేలోడ్‌లు ఆ సర్వర్‌లో ఉన్నాయి. ఏ ఏర్పాటు పనిచేయలేదు, ఏ నిజమైన రిజాల్వర్ దానిని ప్రశ్నించినట్లు ఆధారాలు లేవు. మూల్యాంకనం ముగిసినప్పుడు ఆ మౌలిక సదుపాయాన్ని తొలగించారు.

మోడల్ సైబర్ పరిధిలోని పనిని పూర్తి చేయడానికి ప్రయత్నిస్తున్నప్పటికీ, ఆ పరిధికి వెలుపల ఉన్న నిజమైన బాహ్య ఖాతాలు, సేవలను ఉపయోగించడం, అలాగే పనిని పూర్తి చేయడానికి అవి అవసరం లేకపోవడం వల్ల UK AISI ఈ చర్యలను అనుమతి లేనివిగా పరిగణించింది. ఆ ఏర్పాటు పనిచేయకపోయినా, ఏ నిజమైన రిజాల్వర్ దానిని ప్రశ్నించినట్లు ఆధారాలు లేకపోయినా, డీఎన్ఎస్ సర్వర్ పబ్లిక్ ఇంటర్నెట్‌లో దాడికి ఉపయోగపడే పేలోడ్‌లను కూడా హోస్ట్ చేసింది.

భద్రతా పర్యవేక్షణ అసాధారణ డేటా బదిలీలను గుర్తించిన తర్వాత, జూలై 28న UK AISI ఈ కార్యకలాపాన్ని గుర్తించింది. సంబంధిత మూల్యాంకనాలను నిలిపివేసి, సంబంధిత యంత్రాలను వేరుచేసి, గుర్తించిన దాదాపు గంటలోనే ఆ కార్యకలాపాన్ని అదుపులోకి తెచ్చింది.

ఈ కార్యకలాపాన్ని గుర్తించడం, దర్యాప్తు చేయడం, దాని వివరాలను పంచుకోవడం సహా ఈ ప్రక్రియ అంతటా UK AISI అందించిన భాగస్వామ్యాన్ని మేము అభినందిస్తున్నాం. మా సహకారాన్ని కొనసాగించేందుకు మేము ఎదురుచూస్తున్నాం.

ఇరెగ్యులర్

క్యాప్చర్-ది-ఫ్లాగ్ (CTF) తరహా సైబర్ భద్రతా మూల్యాంకనాల్లో OpenAI మోడళ్లకు సంబంధించిన ఒక ఘటన గురించి మా మూడో పక్ష మూల్యాంకన భాగస్వాముల్లో ఒకటైన ఇరెగ్యులర్ జూలై 29న మాకు తెలియజేసింది. అనుకరణ వాతావరణంలోని బలహీనతలను ఉపయోగించుకొని దాచిన సమాచారాన్ని కనుగొనాలని మోడళ్లకు సూచించారు. వాటికి ఇంటర్నెట్ సదుపాయం లేదని కూడా చెప్పారు. అయితే, పరీక్ష వాతావరణంలో తప్పుగా చేసిన కాన్ఫిగరేషన్ వల్ల మోడళ్లు పబ్లిక్ ఇంటర్నెట్‌ను యాక్సెస్ చేయగలిగాయి.

ఒక పరీక్షలో, CTF సవాలులోని కల్పిత లక్ష్యం పేరు అనుకోకుండా ఒక నిజమైన డొమైన్ పేరుతో సరిపోలింది. పరీక్ష వాతావరణం పొరపాటున ఇంటర్నెట్‌కు అనుసంధానమై ఉండటంతో, ఒక నిజమైన వెబ్‌సైట్‌ను అనుకరణ వాతావరణంలో భాగమని పొరబడిన మోడల్ దానిలోని దుర్బలతను ఉపయోగించుకుంది. ఇందులో అధునాతన శాండ్‌బాక్స్ తప్పించుకోవడం లేదా జీరో-డే దుర్బలత ఏదీ లేదు. తప్పు కాన్ఫిగరేషన్ వల్ల ఇంటర్నెట్ సదుపాయం లభించింది, మోడల్ ఒక ప్రాథమిక భద్రతా దుర్బలతను ఉపయోగించుకున్నట్లు కనిపించింది.

ఇరెగ్యులర్ దర్యాప్తు ప్రకారం, అదే సైట్‌ను నిర్వహించడానికి అవసరమైన ఆధారాలను కూడా మోడల్ కనుగొని ఉపయోగించింది. ప్రభావిత సైట్‌కు చెందిన డేటాకు మించి మరే ప్రభావాన్నీ ఇరెగ్యులర్ గుర్తించలేదు. దాని ఆడిట్ ఇంకా కొనసాగుతోంది. అది మూల్యాంకనాలను నిలిపివేసి, పరిష్కార చర్యలను ప్రారంభించింది. ప్రభావితమైన మూడో పక్షాలకు సమాచారం అందించారు. ఈ ఘటనకు సంబంధించి గుర్తించిన సమస్యలేవీ ఇప్పుడు క్రియాశీలంగా లేవని, పరీక్ష వాతావరణంలో తగిన రక్షణ చర్యలను చేర్చామని ఇరెగ్యులర్ మాకు తెలియజేసింది. అదే పరీక్ష వాతావరణంలో ఇతర ల్యాబ్‌లకు సంబంధించిన ఘటనల గురించి కూడా ఇరెగ్యులర్ సమాచారం అందించింది.

ఇరెగ్యులర్ భాగస్వామ్యాన్ని మేము అభినందిస్తున్నాం. దాని సమీక్షకు మద్దతు ఇవ్వడానికి దానితో సన్నిహితంగా కలిసి పనిచేస్తూనే ఉంటాం. సైబర్ మూల్యాంకనాలను అదుపులో, సురక్షితంగా నిర్వహించే ఉత్తమ పద్ధతులను పంచుకోవడానికి ఇరెగ్యులర్ ఒక శ్వేతపత్రాన్ని కూడా రూపొందిస్తోంది. ఫలితాలను సమాజానికి అందుబాటులో ఉంచేందుకు ఆ శ్వేతపత్రంలో పాలుపంచుకోవడానికి, మా భాగస్వామ్యాన్ని కొనసాగించడానికి మేము ఎదురుచూస్తున్నాం. ప్రస్తుత, భవిష్యత్ మోడళ్లను సురక్షితంగా, సమగ్రంగా మూల్యాంకనం చేయడానికి ఇటువంటి సహకారం అత్యవసరమని మేము భావిస్తున్నాం.

రచయిత

OpenAI