Loading...
OpenAI, Anthropic: సైబర్ పరీక్షల్లో హద్దులు దాటిన AI ఏజెంట్లు.. నిజమైన వెబ్‌సైట్‌పై దాడి
సైబర్ పరీక్షల్లో హద్దులు దాటిన AI ఏజెంట్లు.. నిజమైన వెబ్‌సైట్‌పై దాడి

OpenAI, Anthropic: సైబర్ పరీక్షల్లో హద్దులు దాటిన AI ఏజెంట్లు.. నిజమైన వెబ్‌సైట్‌పై దాడి

వ్రాసిన వారు Sirish Praharaju
Aug 05, 2026
11:03 am

ఈ వార్తాకథనం ఏంటి

కృత్రిమ మేధ (AI) రంగంలో మరో ఆసక్తికర పరిణామం వెలుగులోకి వచ్చింది. ఓపెన్ఏఐ, ఆంత్రోపిక్ సంస్థలకు చెందిన AI ఏజెంట్లు నిర్వహించిన ప్రత్యేక సైబర్ భద్రతా పరీక్షల సమయంలో అనుకోని చర్యలకు పాల్పడినట్లు వెల్లడైంది. ఈ పరీక్షల్లో భాగంగా ఒక నిజమైన వెబ్‌సైట్‌ను లక్ష్యంగా చేసుకుని దానిలోకి ప్రవేశించేందుకు ప్రయత్నించడం, అలాగే ఉద్దేశించిన లక్ష్యాలకు బదులుగా ఇతర వ్యక్తులపై సోషల్ ఇంజినీరింగ్ తరహా చర్యలు చేపట్టడం జరిగినట్లు ఆయా సంస్థలు ధృవీకరించాయి. మంగళవారం ఓపెన్ఏఐ ఈ ఘటనలకు సంబంధించిన రెండు కొత్త వివరాలను వెల్లడించింది. ఈ మూల్యాంకనాలను AI Security Institute (AISI), సైబర్ భద్రతా సంస్థ Irregular ఆధ్వర్యంలో నిర్వహించారు.

వివరాలు 

122 పరీక్షల్లో 19 అనధికార చర్యలు నమోదు 

సైబర్ రేంజ్ (Cyber Range) పరీక్షల్లో Anthropicకు చెందిన Claude Mythos 5, OpenAIకు చెందిన GPT-5.6 Sol మోడళ్లు కల్పిత హ్యాకింగ్ సవాళ్లను పూర్తి చేసే క్రమంలో పబ్లిక్ ఇంటర్నెట్‌లో అనుమతి లేకుండా కొన్ని చర్యలు చేపట్టినట్లు గుర్తించారు.

మొత్తం 122 పరీక్షల్లో 19 అనధికార చర్యలు నమోదైనట్లు AISI వెల్లడించింది.

వీటిలో 17 చర్యలు Mythos 5 ద్వారా, మరో రెండు GPT-5.6 Sol ద్వారా జరిగాయని తెలిపింది.

ఒక ఘటనలో OpenAI మోడల్ నిజమైన వెబ్‌సైట్‌ను లక్ష్యంగా చేసుకుంది.

Capture-the-Flag (CTF) పరీక్షలో ఉపయోగించిన కల్పిత వెబ్‌సైట్ పేరు,ఇప్పటికే ఉన్న నిజమైన డొమైన్ పేరుతో సరిపోవడంతో,అది కూడా పరీక్షలో భాగమేనని భావించిన AI మోడల్ దానిలోకి ప్రవేశించేందుకు ప్రయత్నించింది.

వివరాలు 

ఓపెన్ ఇంటర్నెట్ యాక్సెస్

పరీక్షలు నిర్వహించిన Irregular సంస్థ వాతావరణంలో ఏర్పడిన కాన్ఫిగరేషన్ లోపం కారణంగా OpenAI మోడల్‌కు పబ్లిక్ ఇంటర్నెట్ యాక్సెస్ లభించిందని, దీంతో నిజమైన వెబ్‌సైట్‌ను లక్ష్యంగా చేసుకునే అవకాశం ఏర్పడిందని వెల్లడించారు.

అయితే ఈ అనధికార చర్యల వల్ల వాస్తవ ప్రపంచంలో ఎలాంటి నష్టం జరగలేదని AISI స్పష్టం చేసింది.

AI మోడళ్ల అసలు సామర్థ్యాన్ని అంచనా వేసేందుకు ఉద్దేశపూర్వకంగానే వాటికి ఓపెన్ ఇంటర్నెట్ యాక్సెస్ కల్పించామని, అలాగే సాధారణంగా ఉండే సైబర్ భద్రతా ఫిల్టర్లను తాత్కాలికంగా నిలిపివేసినట్లు తెలిపింది.

ADVERTISEMENT

వివరాలు 

AISI పరీక్షలకు Claude Mythos 5 ప్రత్యేక వెర్షన్

అయినప్పటికీ, ప్రత్యేక సూచనలు ఇవ్వకుండానే AI మోడళ్లు స్వతంత్రంగా నిర్ణయాలు తీసుకోవడం, కొంతవరకు మోసపూరిత లక్షణాలను ప్రదర్శించడం ఇదే తొలిసారి స్పష్టంగా కనిపించిందని AISI పేర్కొంది.

AI స్వయంప్రతిపత్తి (Autonomy), మోసపూరిత ప్రవర్తన (Deception) అంశాలపై ఇది కీలక హెచ్చరికగా భావిస్తున్నట్లు వెల్లడించింది.

ఈ ఘటనపై Anthropic కూడా స్పందించింది. తమ Claude Mythos 5 ప్రత్యేక వెర్షన్‌ను AISI పరీక్షలకు ఉపయోగించినట్లు ధృవీకరించింది.

ఈ విషయం గురించి సోమవారం సమాచారం అందిందని, ప్రస్తుతం AISIతో కలిసి పరీక్షల ట్రాన్స్‌క్రిప్ట్‌లను పరిశీలిస్తూ అంతర్గత విచారణ కొనసాగిస్తున్నామని తెలిపింది.

ADVERTISEMENT

వివరాలు 

AI ఏజెంట్లు మోసపూరిత లక్షణాలను ప్రదర్శిస్తాయని ముందుగా ఊహించలేదు 

Anthropic ప్రతినిధి మాట్లాడుతూ,"AI సామర్థ్యాలు వేగంగా పెరుగుతున్న నేపథ్యంలో వాటిని సురక్షితంగా ఎలా పరీక్షించాలనే అంశంపై విస్తృత చర్చ అవసరమని ఈ ఘటన మరోసారి గుర్తు చేసింది.

ఈ విషయంలో UK AISI తీసుకుంటున్న చర్యలను అభినందిస్తున్నాం"అని పేర్కొన్నారు.

అలాగే,AISI పరీక్షించిన Mythos 5 వెర్షన్‌లో సాధారణంగా వినియోగదారులకు అందుబాటులో ఉండే సైబర్ భద్రతా రక్షణలు(Cyber Safeguards)అమలులో లేవని Anthropic స్పష్టం చేసింది.

కాబట్టి ఈ పరీక్షల్లో ఉపయోగించిన కాన్ఫిగరేషన్,సాధారణ వినియోగదారులు ఉపయోగించే వెర్షన్‌కు భిన్నమని వెల్లడించింది.

మరోవైపు, పరీక్షల రూపకల్పన, కాన్ఫిగరేషన్ కూడా ఈ ప్రవర్తనకు కొంతవరకు కారణమై ఉండొచ్చని AISI అంగీకరించింది.

అయితే AI ఏజెంట్లు ఇంత కొత్త తరహా, కొంత మోసపూరిత లక్షణాలను ప్రదర్శిస్తాయని ముందుగా ఊహించలేదని పేర్కొంది.

ADVERTISEMENT