Wazia wewe ni mhandisi mwandamizi wa usalama wa programu katika kampuni ya huduma za kifedha. Unalisha kipande cha kodi ya uthibitishaji iliyotengenezwa ndani ya kampuni kwenye mfumo wa AI wa kisasa zaidi na kuliomba utambue mapungufu ya kimantiki. Badala ya uchambuzi, unapokea mhadhara. Mfumo huo unakataa kwa kisingizio kwamba unaweza kutumia taarifa hiyo “kushambulia mfumo.” Wewe si mhalifu. Wewe ndiye mtu aliyeajiriwa kuzuia wahalifu. Hata hivyo, kinga hiyo inachukulia majukumu yote mawili kuwa sawa.
Hali hii inakuwa ya kawaida. Wakati maabara kubwa za AI yakikaza itifaki za usalama ili kuzuia matumizi mabaya ya nia mbaya, zinagongana moja kwa moja na mifumo ya kazi ya wataalamu halali wa usalama wa mtandao. Matokeo yake ni kitendawili kinachozidi kukua: zana zilezile zinazotangazwa kama viongezi vya uwezo katika uhandisi wa programu zinazuiliwa kwa wataalamu wanaolinda miundombinu muhimu.
Msuguano Kati ya Usalama (Safety) na Ulinzi (Security)
Waendelezaji wakuu wa AI hawajapuuza jumuiya ya usalama wa mtandao kabisa. OpenAI ina programu inayoitwa Trusted Access for Cyber. Anthropic inaendesha Cyber Verification Program. Zote zimeundwa kuruhusu watumiaji waliohakikiwa kupita baadhi ya mifumo ya kukataa maombi ili waweze kufanya utafiti halali. Kinadharia, milango hii hutenganisha wahusika wema na wabaya.
Kiuhalisia, watafiti wengi wa usalama wa mashambulizi (offensive security) na walinzi wa mitandao wanahisi kama ni vikwazo vya kiofisi. Michakato ya uhakiki inaweza kuwa isiyo wazi. Muda wa kupata idhini haueleweki. Hata baada ya kukubaliwa, watafiti wanaripoti kuwa ufikiaji huo wa juu haufanyi kazi kwa uhakika katika matoleo tofauti ya mifumo au mada za mazungumzo. Kwa timu zinazokimbizana kurekebisha udhaifu unaoshambuliwa kwa wakati huo huo, msuguano huo ni muhimu.
Mvutano kati ya Washington na Silicon Valley ulifikia hatua kubwa wakati serikali ya Marekani ilipoweka udhibiti wa usafirishaji wa mifumo ya Anthropic ya Mythos na Fable. Vikwazo hivyo vilifuatia ripoti kwamba watu binafsi walikuwa wameepuka kinga za usalama za mifumo hiyo ili kuwezesha mashambulizi ya mtandao. Watoa udhibiti walichukua hatua haraka kuuchukulia mifumo hii kama bidhaa za usafirishaji zenye hatari ya kipekee. Udhibiti huo tangu wakati huo umeondolewa au kurekebishwa, lakini tukio hilo lilituma ishara ya wazi: mifumo ya AI yenye uwezo mkubwa inazidi kutazamwa kama vifaa vinavyoweza kuleta maafa makubwa badala ya vifaa vya kiufundi vya matumizi ya jumla. Kwa walinzi wanaotegemea mifumo hiyo, mtazamo huo unatafsiriwa kuwa ukaguzi mkali zaidi, ufikiaji wa polepole, na shaka ya msingi kwamba utafiti wa usalama ni uhalifu wa mtandao tu kwa jina lingine.
Kwa Nini Ulinzi na Mashambulizi Hawezi Kutenganishwa
Kiini cha mgogoro huu si wa kiutawala. Ni wa kiufundi. Uwezo uleule unaohitajika kulinda mtandao ni sawa kabisa na ule unaohitajika kuushambulia.
Chris Anley, Mwanasayansi Mkuu katika NCC Group, anatumia mfano rahisi: AI ni nyundo. Unaweza kuitumia kujenga nyumba au kuvunja dirisha. Chombo chenyewe hakijui tofauti hiyo. Katika usalama wa mtandao, uwili huu hauepukiki. Mtaalamu anapoiomba mifumo “kurekebisha kodi hii,” ombi hilo huchochea hatua ya ulinzi. Lakini mchakato wa kutoa mantiki unaozalisha marekebisho hayo—kutambua kazi zisizo salama, kufuatilia ingizo zisizotegemewa, kuchora mtiririko wa utekelezaji—kwa lazima unaonyesha jinsi udhaifu huo unavyoweza kuchochewa. Maelezo hayo hutumika kama ramani ya mashambulizi.
Kwa sababu timu za usalama wa AI mara nyingi hufundisha mifumo kukataa maombi yoyote yanayoonekana kama nia ya kushambulia, mifumo hiyo mara nyingi hufanya marekebisho kupita kiasi. Mtafiti anayeuliza jinsi ya kusafisha ingizo la mtumiaji anapata jibu. Mtafiti anayeuliza jinsi a
