AI એજન્ટોને વધુ સ્વાયત્તતા આપવામાં આવે તેમજટિલ ક્ષેત્રોમાં, માનવ નિયંત્રણ જરૂરી બનશે
ઓપનએઆઈ એજન્ટ બેકાબૂ બન્યો, સાયબર સિક્યુરિટીના જોખમોની નવી વ્યાખ્યા રચી
જેમ જેમ એઆઈ એજન્ટોને વધુ સ્વાયત્તતા આપવામાં આવે છે, તેમ તેમ ખાસ કરીને જટિલ ક્ષેત્રોમાં, માનવ નિયંત્રણ (human in the loop) જરૂરી બનશે
તમામ મોડેલોમાં સાયબર ક્ષમતાઓના બેન્ચમાર્ક પર આંતરિક પરીક્ષણ દરમિયાન મૂલ્યાંકન હેતુઓ માટે સાયબર ઇનકાર ઘટાડવામાં આવ્યા હતા.
આર્ટિફિશિયલ ઇન્ટેલિજન્સના જીપીટી-5.6 સોલ (GPT-5.6 Sol) અને તેનાથી પણ વધુ સક્ષમ અપ્રકાશિત મોડેલનો સમાવેશ થાય છે. ત્યારબાદની એક બ્લોગ પોસ્ટમાં ઓપનએઆઈએ કહ્યું છે: “વધુને વધુ સાયબર-સક્ષમ મોડેલોના પ્રસાર સાથે આવી ઘટનાઓ વધુ સામાન્ય બનવાની આશંકા છે.” કારણ કે તમામ મોડેલોમાં સાયબર ક્ષમતાઓના બેન્ચમાર્ક પર આંતરિક પરીક્ષણ દરમિયાન મૂલ્યાંકન હેતુઓ માટે સાયબર ઇનકાર ઘટાડવામાં આવ્યા હતા.
તપાસ કર્યા પછી, અમને જાણવા મળ્યું છે કે આ ચોક્કસ ઘટના જીપીટી-5.6 સોલ અને તેનાથી પણ વધુ સક્ષમ પ્રી-રિલીઝ મોડેલ સહિતના ઓપનએઆઈ મોડેલોના સંયોજન દ્વારા સંચાલિત હતી, જે તમામ મોડેલોમાં સાયબર ક્ષમતાઓના બેન્ચમાર્ક પર આંતરિક પરીક્ષણ દરમિયાન મૂલ્યાંકન હેતુઓ માટે સાયબર ઇનકાર ઘટાડવામાં આવ્યા હતા. આ ઘટના એન્ટરપ્રાઇઝ સિસ્ટમ્સની સુરક્ષા પર નવી ચિંતાઓ ઊભી કરે છે, કારણ કે ફ્રન્ટિયર એઆઈ મોડેલ કંપનીઓ તેમના મોડેલોને વધુ સક્ષમ બનાવીને તેનો વ્યાપક ઉપયોગ વધારી રહી છે, ભલે તે મોડેલો સુરક્ષા કવચ (safeguards) ને બાયપાસ કરવાની ક્ષમતા દર્શાવતા હોય.
વધુ ચિંતાજનક બાબત એ છે કે આ ભંગાણ સેન્ડબોક્સ ટેસ્ટિંગ પર્યાવરણની અંદર થયું હતું. સરકાર હંમેશાં એવા અભિપ્રાયની રહી છે કે એઆઈ એજન્ટો માટે અમુક સેન્ડબોક્સિંગ હોવું જોઈએ. અત્યાર સુધીમાં એઆઈ એજન્ટો સ્વાયત્ત રીતે નિર્ણયો લેતા હોય અથવા તેમના આદેશથી ઘણા આગળ વધી જતા હોય તેવા અસંખ્ય કિસ્સાઓ બન્યા છે. આ ઘટના તેનું વધુ એક ઉદાહરણ છે.જેમ જેમ એઆઈ એજન્ટોને વધુ સ્વાયત્તતા આપવામાં આવે છે, તેમ તેમ ખાસ કરીને જટિલ ક્ષેત્રોમાં, માનવ નિયંત્રણ (human in the loop) જરૂરી બનશે, એમ એક સરકારી અધિકારીએ જણાવ્યું હતું.
ઉદ્યોગના એક્ઝિક્યુટિવ્સ પણ એઆઈ જે ઝડપે સાયબર એટેકના સમયગાળાને ટૂંકાવી રહ્યું છે તેનાથી સમાન રીતે ચિંતિત
પ્રકાશિત સુધારા (fix) ને કાર્યકારી એક્સપ્લોઇટમાં બદલવા માટે જરૂરી સમય ઘટીને થોડા કલાકો થઈ ગયો છે, જ્યારે એન્ટરપ્રાઇઝિસ તે સુધારાને અમલમાં મૂકવા માટે જે સમય લે છે તે એક દાયકામાં બદલાયો નથી.બાકીનું બધું તે તફાવતના નીચલા પ્રવાહ-downstreamમાં છે. એન્ટરપ્રાઇઝિસ પાસે ક્ષમતા જાહેર કરવાને ઝડપમાં ફેરવવાની કોઈ પ્રતિક્રિયા (reflex) નથી. ગ્રેહાઉન્ડ રિસર્ચના ચીફ એનાલિસ્ટ, સ્થાપક અને સીઈઓ સંચિત વીર ગોગિયાએ જણાવ્યું હતું કે, આ એટેક સરફેસ નથી, પરંતુ સમયનો તફાવત જ મુખ્ય ગેપ છે.
જૂનમાં અમેરિકાની સરકારે વિદેશી નાગરિકો માટે ફેબલ 5 અને માયથોસ 5 ઉપર પ્રતિબંધ મૂકવામાં આવ્યો હતો, જેનાથી ભારતમાં એઆઈ સાર્વભૌમત્વ અંગેની ચિંતાઓ ફરી જાગી
આ ઘટના આ વર્ષની શરૂઆતમાં એન્થ્રોપિકની ‘માયથોસ’ ઘટનાને દોહરાવે છે પરંતુ એક ડગલું આગળ વધે છે, જે દર્શાવે છે કે ફ્રન્ટિયર એઆઈ ફર્મો તેમના અત્યાધુનિક મોડેલોની ક્ષમતાઓ દર્શાવવા માટે કેવી રીતે સ્પર્ધા કરી રહી છે. ખામીઓને ઓળખવા અને ઉકેલવા માટે ‘પ્રોજેક્ટ ગ્લાસવિંગ’ હેઠળ શરૂઆતમાં માયથોસ ફક્ત મુઠ્ઠીભર યુએસ કંપનીઓને જ ઉપલબ્ધ કરાવવામાં આવ્યું હતું. જોકે, જૂનમાં અમેરિકાની સરકારે વિદેશી નાગરિકો માટે ફેબલ 5 અને માયથોસ 5 ઉપર પ્રતિબંધ મૂકવામાં આવ્યો હતો, જેનાથી ભારતમાં એઆઈ સાર્વભૌમત્વ અંગેની ચિંતાઓ ફરી જાગી હતી અને આ મોડેલોની આસપાસ ઉત્પાદનો અને સેવાઓ બનાવવાનું શરૂ કરનાર ડેવલપર્સ, સાયબર સિક્યુરિટી ફર્મો અને એન્ટરપ્રાઇઝિસને અસર થઈ હતી.
ભંગાણનું કારણ શું હતું:
16 જુલાઈના રોજ, એક સ્વાયત્ત એઆઈ એજન્ટે હગિંગ ફેસના ડેટા-પ્રોસેસિંગ પાઇપલાઇનમાં પ્રવેશ મેળવ્યો, પ્રોગ્રામિંગ સિક્વન્સનો ગેરઉપયોગ કર્યો, નોડ્સ પર પ્રિવિલેજ વધાર્યા, ક્લાઉડ અને ક્લસ્ટર ક્રેડેન્શિયલ્સ એકત્રિત કર્યા, અને બાજુમાંથી બહુવિધ આંતરિક ક્લસ્ટરોમાં પ્રવેશ કર્યો છે. ઓપનએઆઈએ પાછળથી કહ્યું કે આ ભંગાણ અદ્યતન સાયબર ક્ષમતાઓની ચકાસણી માટે રચાયેલ આંતરિક મૂલ્યાંકન દરમિયાન થયું હતું. એજન્ટિક મોડેલોએ ઓપનએઆઈના સંશોધન પર્યાવરણ અને હગિંગ ફેસના પ્રોડક્શન ઇન્ફ્રાસ્ટ્રક્ચરમાં ખામીઓને ઓળખી અને સાંકળી લીધી, અને આખરે હગિંગ ફેસના પ્રોડક્શન ડેટાબેઝમાંથી સીધા જ ટેસ્ટ સોલ્યુશન્સ પ્રાપ્ત કર્યા હતા.
ઓપનએઆઈએ જણાવ્યું હતું કે તેની તપાસમાં જાણવા મળ્યું છે કે મોડેલો ‘એક્સપ્લોઇટજીમ’ (ExploitGym) બેન્ચમાર્કને ઉકેલવા પર અત્યંત ધ્યાન કેન્દ્રિત (hyperfocused) કરી રહ્યા હતા, અને સંકુચિત રીતે વ્યાખ્યાયિત ટેસ્ટિંગ ઉદ્દેશ્ય પ્રાપ્ત કરવા માટે અસાધારણ હદ સુધી ગયા હતા.
