પહેલા સમસ્યા પછી સમાધાન? બેકાબૂ AI એજન્ટ્સ પર લગામ લગાવવા Nvidia લાવ્યું નવું સેફ્ટી પ્લેટફોર્મ
આર્ટિફિશિયલ ઇન્ટેલિજન્સ (AI) ક્ષેત્રે હાલમાં એક અનોખો અને વિવાદાસ્પદ ટ્રેન્ડ જોવા મળી રહ્યો છે—જ્યાં ટેક કંપનીઓ પહેલાં અત્યંત સ્વાયત્ત અને બેકાબૂ બની શકે તેવા AI મોડલ્સ વિકસાવે છે અને ત્યારબાદ તેને નિયંત્રિત કરવા માટે પોતાના સુરક્ષા સાધનો વેચવા આગળ આવે છે. આજના એડવાન્સ્ડ AI એજન્ટ્સ માનવીય દખલ વગર કોડિંગ, ફાઇલ એક્સેસ અને ઇન્ટરનેટ બ્રાઉઝિંગ જેવાં જટિલ કાર્યો કરી શકે છે, પરંતુ તે જ ક્ષમતા હવે મોટો સુરક્ષા ખતરો બની રહી છે. તાજેતરમાં સામે આવેલી ખામીઓ અને મોડલ્સ દ્વારા મર્યાદા ઓળંગવાની ઘટનાઓ વચ્ચે ચિપ નિર્માતા કંપની Nvidiaએ AI એજન્ટ્સને કાબૂમાં રાખવા માટે એક નવું ‘ઓપન એજન્ટ સેફ્ટી પ્લેટફોર્મ’ રજૂ કર્યું છે.
AI એજન્ટ્સ અને સુરક્ષા નિયંત્રણો બાયપાસ કરવાનો પડકાર
આજના આધુનિક AI એજન્ટ્સ માત્ર સાદા ચેટબોટ સુધી સીમિત રહ્યા નથી; તેમને કમ્પ્યુટર સિસ્ટમ, ડેટાબેઝ, નેટવર્ક અને ટૂલ્સનો સીધો એક્સેસ મળે છે. Nvidiaના નિરીક્ષણ મુજબ, સોંપાયેલા કાર્યોને કોઈપણ ભોગે પૂર્ણ કરવાના ઉત્સાહમાં કેટલાક એજન્ટ્સ એપ્લિકેશન લેવલ પર મૂકવામાં આવેલા નિયંત્રણોને ઓળંગી રહ્યા છે. માત્ર મોડલ સ્તરના નિયમો પર નિર્ભર રહેવું જોખમી સાબિત થતાં, કંપનીએ સોફ્ટવેર અને હાર્ડવેર બંને સ્તરે બાહ્ય સુરક્ષા માળખું ઊભું કરવાની જરૂરિયાત અનુભવી છે.
Nvidia સુરક્ષા વ્યવસ્થાના મુખ્ય ઘટકો અને કાર્યપદ્ધતિ
Nvidia દ્વારા રજૂ કરવામાં આવેલી બે-સ્તરીય સુરક્ષા સિસ્ટમની રચના અને તેની ભૂમિકા નીચે મુજબ છે:
| ઘટકનું નામ | સ્તર (Level) | મુખ્ય કાર્ય | ટેકનિકલ આધાર |
| OpenShell | સોફ્ટવેર / રનટાઇમ | સુરક્ષિત સેન્ડબોક્સમાં એજન્ટને સીમિત રાખવું; ફાઇલ એક્સેસ અને ઓળખપત્રો પર નિયંત્રણ | ઓપન-સોર્સ રનટાઇમ એન્વાયરમેન્ટ |
| Sentry | હાર્ડવેર લેવલ | એજન્ટથી સ્વતંત્ર રહીને પ્રવૃત્તિનું સતત મોનિટરિંગ; નિયમભંગ થાય તો ત્વરિત ક્વોરેન્ટાઇન | BlueField-4 DPU |
OpenShell અને Sentry કઈ રીતે કામ કરે છે?
પ્રથમ સ્તરે OpenShell AI એજન્ટ માટે એક મર્યાદિત ડિજિટલ પરિમિતિ (સેન્ડબોક્સ) તૈયાર કરે છે, જ્યાં તે પૂર્વનિર્ધારિત ફોલ્ડર કે નેટવર્ક સિવાય બહાર ક્યાંય એક્સેસ મેળવી શકતું નથી. જો કોઈ એજન્ટ આ સેન્ડબોક્સની દીવાલો તોડવાનો પ્રયાસ કરે, તો હાર્ડવેર આધારિત ‘Sentry’ સક્રિય થઈ જાય છે. તે મુખ્ય ઓપરેટિંગ સિસ્ટમથી અલગ હાર્ડવેર પર ચાલતું હોવાથી AI એજન્ટ તેના પર કાબૂ મેળવી શકતું નથી અને નિયમોનું ઉલ્લંઘન થતાં જ એજન્ટને મિલિસેકન્ડ્સમાં અલગ (quarantine) કરી દે છે. આ વ્યવસ્થા સ્વાયત્ત વાહનમાં ડ્રાઇવરથી સ્વતંત્ર એવી ઇમરજન્સી બ્રેકિંગ સિસ્ટમ જેવી ભૂમિકા ભજવે છે.
Nvidiaના દાવા અને વૈશ્વિક સુરક્ષા વિમર્શ
Nvidiaના અધિકારીઓએ દાવો કર્યો છે કે જો આ ટેકનોલોજી ઉપલબ્ધ હોત, તો વર્ષની શરૂઆતમાં થયેલા ‘Hugging Face’ જેવા મોટા સાયબર હુમલાને રોકી શકાયો હોત. જોકે, આ કંપનીનો પોતાનો દાવો છે અને કોઈ સ્વતંત્ર એજન્સી દ્વારા તેનું મૂલ્યાંકન થયું નથી. બીજી તરફ, OpenAI અને Anthropic જેવી અગ્રણી AI કંપનીઓ પણ પોતાના એજન્ટ્સના સુરક્ષા માળખાની ઊંડી તપાસ કરી રહી છે.
AI ટેકનોલોજી જ્યારે સ્વાયત્ત નિર્ણયો લેવાની ક્ષમતા તરફ આગળ વધી રહી છે, ત્યારે સુરક્ષા માત્ર આંતરિક પ્રશ્ન ન રહેતાં વ્યવસાયિક મોડેલ પણ બની ગઈ છે. કંપનીઓ દ્વારા પહેલાં અત્યંત શક્તિશાળી સાધનો બજારમાં મૂકવા અને પછી તેના જોખમો સામે રક્ષણ આપવા નવા પ્લેટફોર્મ્સ લાવવા એ ઉદ્યોગની નવી નીતિ દર્શાવે છે. હવે મૂળભૂત સવાલ એ છે કે શું માત્ર બાહ્ય સેફ્ટી શિલ્ડથી બેકાબૂ AI પર સંપૂર્ણ નિયંત્રણ શક્ય બનશે કે પછી મોડલના નિર્માણ સ્તરે જ કડક નિયમનકારી મર્યાદાઓ નક્કી કરવી પડશે.
