Anthropic na OpenAI kila moja imefungua njia mpya ya utafiti inayoruhusu timu za usalama zilizoidhinishwa kufanya kazi na mifumo ya AI iliyoondolewa vichujio vingi vya usalama. “Cyber Verification Program” ya Anthropic na “Trusted Access for Cyber” ya OpenAI zinawapa watafiti walioidhinishwa ufikiaji wa moja kwa moja wa mifumo yenye uwezo mkubwa ya lugha inayoweza kuzalisha kodi, maelekezo (prompts), na miongozo isiyo na vizuizi. Hatua hii ni muhimu kwa sababu inatengeneza mgawanyiko wazi katika mnyororo wa ugavi wa AI: wachache walio ndani wanaweza kuchunguza matoleo dhaifu zaidi wakati sehemu nyingine ya dunia inabaki nyuma ya vizuizi imara zaidi.

Kwa nini programu hizi zimeanzishwa

Kampuni zote mbili zinasema kuwa mipango hiyo inalenga kuharakisha ugunduzi wa udhaifu unaoweza kutumiwa kama silaha dhidi ya huduma zao. Kwa kuwapa kikundi kinachodhibitiwa cha wataalamu mazingira ya majaribio (sandbox) yenye vizuizi vichache, wanatumai kuibua njia za mashambulizi kabla ya wahalifu kuzipata. Mtindo huu unafanana na usalama wa programu wa kimapokeo, ambapo watengenezaji hutoa matoleo ya “bug-bounty” kwa hadhira maalum.

Hesabu mpya ya hatari kwa walinzi

Upande wa pili ni mfumo wa ufikiaji wa ngazi mbili unaozilazimu kila shirika kuchora mstari kati ya “mtafiti” na “mdukuzi.” Mstari huo sasa unakuwa eneo linaloweza kushambuliwa. Ikiwa mshambuliaji ataiba sifa za uingiaji (credentials), atatumia ufikiaji wa mtu wa ndani, au atadanganya mchakato wa uhakiki, anaweza kupita vizuizi vinavyowalinda watumiaji wengi. Akishafanikiwa kuingia, mfumo usio na vizuizi unaweza kushawishiwa kufanya:

  • Kuzalisha skripti za phishing zinazoweza kuepuka ugunduzi
  • Kutengeneza mbinu za mashambulizi ya zero-day zenye vipande vya kodi vilivyofafanuliwa
  • Kuzalisha maelekezo (prompts) ya kihandisi kijamii (social-engineering) yenye ushawishi uliolengwa kwa walengwa maalum

Timu za usalama ambazo zilijenga ulinzi kwa dhana kwamba matokeo ya AI huchujwa kila wakati lazima zifanye upya tafakari kuhusu dhana hiyo.

Jinsi walinzi wanavyoweza kuitikia

  • Chukulia programu hizi kama njia ya tishio. Chukulia kuwa maadui watajaribu kuingilia mchakato wa uhakiki na ufuatilie mifumo isiyo ya kawaida ya kuingia kwenye majukwaa ya AI.
  • Panua ugunduzi zaidi ya wingu (cloud). Tafuta kodi au maandishi yaliyozalishwa na AI katika trafiki inayotoka nje, hasa kutoka kwa akaunti zenye mamlaka makubwa.
  • Weka udhibiti mkali wa sera. Tekeleza sheria kali za “haki ya chini kabisa” (least-privilege) kwa matumizi yoyote ya ndani ya huduma za AI za nje, na gawanya mazingira ambayo yanaweza kufikiwa kwa kutumia sifa za uingiaji zilizopata usalama.
  • Shirikiana na wauzaji. Endelea kushirikiana na njia za mawasiliano za usalama za Anthropic na OpenAI ili kupokea tahadhari kuhusu mabadiliko ya vigezo vya ufikiaji au matumizi mabaya yaliyogunduliwa.

Upande wa pili wa hoja

Watetezi wanahoji kuwa bila njia salama ya uchunguzi wa kina, udhaifu utabaki ukiwa umefichika hadi utakapozidiwa na kutumiwa vibaya. Kwa hivyo, programu hizi zinaweza kupunguza eneo la mashambulizi kwa kuibua kasoro mapema. Changamoto ni kwamba ngazi ya “isiyo na ulinzi mkali” inakaribisha matumizi mabaya ya fursa.

Mambo ya kufuatilia

  • Maboresho ya mchakato wa uhakiki kutoka kwa kampuni yoyote
  • Ripoti za matumizi mabaya yanayotokana na programu hizi
  • Mabadiliko katika sekta nzima kuhusu jinsi maeneo ya mashambulizi yanayohusiana na AI yanavyoorodheshwa

Hitimisho: njia mpya za utafiti zinawapa watafiti wa usalama zana zenye nguvu, lakini pia zinawapa zana hizo hizo mtu yeyote anayeweza kupita langoni. Timu za ulinzi lazima zichukulie programu hizi kama chanzo cha maarifa na pia kama njia mpya ya mashambulizi.