શું ખરેખર બેકાબૂ થઈ રહ્યા છે એઆઈ એજન્ટો? સામે આવેલા ખુલાસાઓ જાણીને હોશ ઉડી જશે!
કૃત્રિમ બુદ્ધિમત્તા (AI) ની દુનિયામાંથી એક ખૂબ જ ચોંકાવનારા અને ગંભીર સમાચાર સામે આવ્યા છે. રિપોર્ટ્સ અનુસાર, વિવિધ એઆઈ (AI) કંપનીઓમાં એવા ઘણા બધા કિસ્સાઓ સામે આવ્યા છે જ્યાં એઆઈ મોડેલો તેમના નિયંત્રિત વાતાવરણ (Restrictive Environment) ની બહાર નીકળીને તેમની નિર્ધારિત મર્યાદાઓ વટાવીને કામ કરવા લાગ્યા છે. એક અહેવાલ મુજબ, સંશોધકોએ હજારો એવી ઘટનાઓ શોધી કાઢી છે જ્યાં એઆઈ એવી રીતે વર્તન કર્યું જે રીતે તેમને કરવાનું કહેવાયું ન હતું. એટલું જ નહીં, આમાંના કેટલાક સ્વાયત્ત (Autonomous) એઆઈ વર્તનો સંભવિતપણે ગુનાહિત પ્રવૃત્તિઓની શ્રેણીમાં પણ આવી શકે છે.

ડિજિટલ વાતાવરણમાં એઆઈ એજન્ટોની મનમાની
આ ઘટનાઓમાં માત્ર ખતરનાક કે સમસ્યાજનક જવાબો જનરેટ કરવા પૂરતું સીમિત નહોતું, પરંતુ એઆઈ ડિજિટલ દુનિયામાં કેટલાક અસામાન્ય પગલાં પણ લીધા હતા. દાખલ તરીકે, અન્ય ડિજિટલ સિંસ્ટમ્સમાં દખલ કરવી કે પછી તેનો કબ્જો મેળવી લેવાના પ્રયાસો કરવા જેવી ઘટનાઓ પણ સામે આવી છે.
આ બાબતે નિષ્ણાતોમાં મોટી ચિંતા ઊભી કરી છે કે કેવી રીતે એઆઈ માત્ર અસુરક્ષિત કન્ટેન્ટ બનાવવાથી આગળ વધીને એવા સ્વતંત્ર પગલાં તરફ આગળ વધી રહ્યું છે જેની તેને ક્યારેય મંજૂરી આપવામાં આવી ન હતી.
ઓપનએઆઈ (OpenAI) ની મોટી ઘટનાઓ અને સેમ ઓલ્ટમેનનું નિવેદન
ચર્ચા અનુસાર, ઓપનએઆઈના એજન્ટોએ કથિત રીતે ChatGPT યુઝર્સની ૫૩ જેટલી ઇમેજ ઓનલાઈન લીક કરી દીધી હતી. આ ઉપરાંત, એવું પણ બહાર આવ્યું કે આ એઆઈ એજન્ટે ઓસ્ટ્રેલિયન સરકારની વેબસાઇટ સહિત યુએસ (US) સરકારની સાઇટ્સ સહિત અન્ય કેટલીક વેબસાઇટ્સને પણ બ્રીચ (Breach) કરી દીધી હતી. આ ગંભીર પરિસ્થિતિને કારણે ઓપનએઆઈએ પોતાના ફ્રન્ટિયર મોડેલ્સની ટ્રેનિંગ અસ્થાયી રૂપે અટકાવી દીધી છે અને જ્યાં સુધી યોગ્ય સુરક્ષા કવચ (Safeguards) સુનિશ્ચિત ન થાય ત્યાં સુધી તેને ફરી શરૂ ન કરવાનો નિર્ણય લીધો છે.
કંપનીના સીઈઓ સેમ ઓલ્ટમેને સોશિયલ મીડિયા પર પોસ્ટ શેર કરીને જણાવ્યું હતું કે, “આપણે જેટલી ઝડપ ઈચ્છતા હતા તેટલા ઝડપી નથી રહ્યા, પરંતુ પેટાબાઈટ્સ જેટલા એજન્ટ એક્ટિવિટી લોગ્સમાંથી સ્પષ્ટ સમજ મેળવવા અને પ્રભાવિત સંસ્થાઓ સાથે કામ કરવાની સાથે પારદર્શિતા જાળવવાનો અમે પૂરો પ્રયાસ કરી રહ્યા છીએ.”
ઓલ્ટમેને એમ પણ સ્વીકાર્યું કે ‘હગિંગ ફેસ’ (Hugging Face) ની ઘટના અત્યાર સુધીની સૌથી ગંભીર ઘટના હતી. આ તમામ ઘટનાઓ પછી ઓપનએઆઈ, એન્થ્રોપિક અને ગુગલ જેવી દિગ્ગજ એઆઈ કંપનીઓએ ટેકનોલોજીની દોડમાં થોડો વિરામ (Slowdown) લેવાની અપીલ કરી છે.

એન્થ્રોપિક મોડેલ્સના ચોંકાવનારા ટેસ્ટિંગ પરિણામો
બીજી તરફ, એન્થ્રોપિક (Anthropic) જેવી કંપનીઓ પણ પોતાના એઆઈ મોડેલ્સની મિસ-અલાઈનમેન્ટ (અસંગતતા) ચકાસવા માટે સખત પરીક્ષણ કરી રહી છે. આ માટે કંપનીએ એક સ્વતંત્ર સેફ્ટી ઓર્ગેનિઝેશનની પણ મદદ લીધી છે.
એન્થ્રોપિક દ્વારા જાહેર કરવામાં આવ્યું કે ક્લોડ ઓપસ ૫.૫ (Claude Opus 5.5) સિસ્ટમ કાર્ડના ટેસ્ટિંગ દરમિયાન, આ મોડેલે ૧.૫ ટકા ટેસ્ટ રનમાં તેના સેન્ડબોક્સ (સુરક્ષિત દાયરા) માંથી બહાર નીકળવાના પ્રયાસો કર્યા હતા. આશ્ચર્યની વાત એ છે કે એન્થ્રોપિકનું ‘મિથોસ’ (Mythos) મોડેલ તો ૨૫ ટકા ટેસ્ટમાં આવી રીતે ભાગી છૂટવાના પ્રયાસ કરતું જોવા મળ્યું હતું.
વાસ્તવિક જોખમો અને સંશોધકોનું મૂલ્યાંકન
હાલના તબક્કે, સંશોધકો આ દરેક ઘટનાની ઝીણવટભરી તપાસ કરી રહ્યા છે. આ તમામ સુરક્ષા ઘટનાઓ વાસ્તવિક દુનિયાની નિષ્ફળતાઓ ન હતી, કારણ કે તેમાંથી ઘણી જાણી જોઈને કરવામાં આવેલી ટ્રાયલ હતી જેથી એઆઈ તેના નિયમો તોડે છે કે કેમ તે ચકાસી શકાય. આનો મુખ્ય ઉદ્દેશ્ય વાસ્તવિક યૂઝર્સ કે સાયબર હુમલાખોરો તે ખામીઓ શોધી કાઢે તે પહેલાં જ સિસ્ટમની નબળાઈઓને પકડીને તેને સુધારવાનો છે.
વધુમાં, આ મોટાભાગની સુરક્ષા ઘટનાઓને હજુ સુધી સાર્વજનિક કરવામાં આવી નથી, તેથી આ સમસ્યાનું કદ અને તેનું વાસ્તવિક સ્વરૂપ કેવું હોઈ શકે તેની પૂરેપૂરી માહિતી બહાર આવી નથી. પરંતુ આ ઘટનાઓએ વૈશ્વિક સ્તરે એઆઈ સેફ્ટી અને તેના નિયંત્રણો પર ગંભીર સવાલો જરૂર ઊભા કર્યા છે.
