04 Njia za kuepuka
Njia za kutoka zinazopatikana kihalisia
Udhibiti wa kiufundi na kitaasisi unaamua kama hali mbaya zaidi katika sura ya 02 zitakuwa na uwezekano mkubwa zaidi au mdogo; maandalizi ya kaya hayawezi kuchukua nafasi yake.
Njia za kiufundi za usalama
- Utafiti wa ufafanuzi wa ndani (interpretability). Kuchunguza uwakilishi wa mfano na hesabu za ndani kama nyongeza moja kwa tathmini za kitabia, udhibiti wa ufikiaji, na ufuatiliaji wa matumizi.
- Usimamizi unaoweza kupanuka. Mbinu — mjadala, uundaji wa zawadi wa kurudia (recursive reward modeling), ujumlishaji kutoka dhaifu kwenda imara — zinazokusudiwa kusaidia wasimamizi wenye uwezo mdogo kusimamia mifumo yenye uwezo mkubwa zaidi.
- Utafiti wa urekebishaji (corrigibility). Kuchunguza jinsi mifumo inavyoweza kubaki tayari kupokea marekebisho halali, mabadiliko, na kuzimwa; hakuna suluhisho linaloweza kuvumilia ukubwa lililothibitishwa.
- Utawala wa uwezo wa kompyuta (compute). Vizuizi vya usafirishaji kulingana na mamlaka, ufuatiliaji wa miundombinu, na vizingiti vinavyotumika kama viwakilishi visivyokamilika vya uwezo — si kama ufafanuzi wa AGI au usalama.
Mkurugenzi mtendaji wa Anthropic alitoa hoja kwa ajili ya la kwanza kati ya haya katika insha yake ya 2025 kuhusu mada hii:
Dario Amodei argues that researchers still lack a precise account of why models choose particular outputs.
The Urgency of Interpretability, Primary source
Njia za kitaasisi
Uratibu wa kimataifa ni muhimu kwa sababu udhibiti wa upande mmoja unaweza kubadilisha vichocheo vya usalama na nafasi ya ushindani. Mazingira ya sera si ya hiari kabisa tena: Sheria ya AI ya EU inaweka wajibu unaofunga kwa watoa huduma walio ndani ya wigo wake, wakati mifumo ya usalama ya maabara na ahadi za mikutano ya kilele bado ni za hiari kwa kiasi kikubwa. Hakuna mkataba wa kimataifa unaofunga wa udhibiti wa silaha za mifano ya hali ya juu uliopo kwa sasa.
Mwanzo mmoja wa mapema wa kimataifa ulikuwa tamko lisilofunga lililoungwa mkono na nchi 28 na EU katika Mkutano wa kwanza wa Kimataifa wa Usalama wa AI:
28 nations and the European Union commits signatories to AI that is designed, developed, deployed and used safely and responsibly.
GOV.UK, Signed statement
- Tathmini ya kabla ya matumizi inayolingana na hatari kwa uwezo hatari kabla ya kutolewa bila vizuizi.
- Taarifa ya matukio inayowawezesha wasimamizi na watengenezaji kujifunza kutokana na kushindwa kubwa na matukio ya karibu kutokea.
- Kanuni za dhima zinazozingatia udhibiti, ujuzi, chanzo, na uwezo wa kuzuia madhara.
Anachoweza kufanya mtaalamu wa teknolojia binafsi
Wasomaji wanaweza kuathiri sera wakiwa wapiga kura, wafanyakazi, watafiti, wateja, wawekezaji, na wanachama wa mashirika ya kiraia. Chaguzi za vitendo ni pamoja na kuchangia au kufadhili utafiti wa ufafanuzi wa ndani na urekebishaji (alignment); kusukuma mazoea ya usalama ndani ya shirika lako mwenyewe iwapo unatumia mifumo ya AI katika uzalishaji; kusaidia miundombinu ya taarifa na tathmini iliyotajwa hapo juu badala ya kuichukulia kama msuguano wa kisheria; na kuangalia chanzo na ushahidi nyuma ya madai yenye kushawishi badala ya kudhania ama udanganyifu wa kiotomatiki au maafikiano halisi.