Is-sigurtà tal-AI: xi tfisser tassew u għaliex timporta għalik
Il-problema vera tas-sigurtà
Is-sigurtà tal-AI. It-terminu jqajjem stampi ta' robots li joqtlu. Skynet. Xenarji ta' Terminator. Biżgħat tal-finzjoni xjentifika.
Dak mhux il-problema vera. Mhux illum. Mhux għal snin.
Il-kwistjonijiet veri tas-sigurtà tal-AI huma ta' kuljum. Prattiċi. Qed jiġru issa stess. Algoritmi ta' reklutaġġ preġudikati. Dijanjosi mediċi żbaljati. Vetturi awtonomi li jieħdu deċiżjonijiet ħżiena fi frazzjoni ta' sekonda. Dawn mhumiex finzjoni xjentifika. Huma r-realtà tal-lum.
Li tifhem xi tfisser tassew is-sigurtà tal-AI jgħinek tevalwa s-sistemi tal-AI. Itlob aħjar. Użahom b'mod sikur.
X'inhi tassew is-sigurtà tal-AI
Is-sigurtà tal-AI tfisser li tiżgura li s-sistemi tal-AI jaġixxu kif maħsub. Jagħmlu dak li rridu. Ma jagħmlux dak li ma rridux. Jidher sempliċi. Mhux.
Tliet Sfidi Ewlenin:
- 1. Speċifikazzjoni: Niddefinixxu dak li verament irridu. Jirriżulta li huwa diffiċli li tispeċifika "imġiba tajba" b'mod preċiż. Il-valuri umani huma kumplessi. Jiddependu mill-kuntest. Kultant kontradittorji.
- 2. Robustezza: L-AI taħdem b'mod korrett fis-sitwazzjonijiet kollha. Mhux biss fix-xenarji ta' taħriġ. Każijiet estremi. Inputs avversarji. Il-kaos tad-dinja reali. L-AI spiss tonqos eżattament fejn l-aktar importanti.
- 3. Allinjament: L-għanijiet tal-AI jaqblu mal-għanijiet umani. Mhux tilgħab mas-sistema. Mhux tottimizza għall-ittra tar-regola waqt li tikser l-ispirtu. Allinjament ġenwin mal-intenzjoni umana.
Jekk tiżbalja f'xi waħda minn dawn, l-AI tikkawża ħsara. Anki bl-intenzjonijiet tajba. Anki bit-teknoloġija sofistikata.
Ir-regolaturi Ewropej jifhmu dan mill-qrib. L-Att dwar l-AI tal-UE jikklassifika s-sistemi tal-AI skont il-livell ta' riskju: minimu, limitat, għoli, u inaċċettabbli. Is-sistemi b'riskju għoli (apparat mediku, infrastruttura kritika, infurzar tal-liġi, deċiżjonijiet ta' impjieg) jiffaċċjaw rekwiżiti stretti. L-ispjegabbiltà mhix għażla. L-ittestjar tar-robustezza mhuwiex negozjabbli. Is-sorveljanza umana mhijiex xi ħaġa sabiħa li jkollok. Hija l-liġi. Il-kumpaniji Amerikani li qed jiskopru dan bl-aktar mod diffiċli issa jsejħulu "piż regolatorju". Il-kumpaniji Ewropej isejħulu "responsabbiltà bażika tal-inġinerija".
Għaliex l-AI attwali mhix sigura (il-verità onesta)
L-AI moderna għandha problemi fundamentali ta' sigurtà:
Il-Problema tal-Kaxxa s-Sewda:
Ma tistax tara ġewwa. In-netwerks newrali huma opaki. Biljuni ta' piżijiet. L-ebda loġika interpretabbli mill-bniedem. Il-mudell jaħdem (jew ma jaħdimx). Ma tistax tara għaliex.
Dan ifisser: ma tistax tivverifika s-sigurtà. Ma tistax tawditja d-deċiżjonijiet. Ma tistax issewwi problemi speċifiċi mingħajr ma terġa' tħarreġ. Tittestja b'mod estensiv u ttama li jaħdem fil-produzzjoni. Dik mhix sigurtà. Dik hija ottimiżmu.
Immaġina inġinier ċivili Olandiż jipproponi diga fejn il-kalkoli huma "afda fija, in-netwerk newrali jgħid li żżomm." Jew inġinier tal-karozzi Ġermaniż jiċċertifika l-brejkijiet b'"ħarreġnieh fuq miljuni ta' eżempji." It-TÜV jidħku bihom u joħorġuhom mill-bini. Madankollu, dan huwa preċiżament kif niskjeraw l-AI għal deċiżjonijiet kritiċi simili: dijanjosi medika, sewqan awtonomu, valutazzjoni tar-riskju finanzjarju. L-approċċ ibbażat fuq il-fidi għall-inġinerija li l-Ewropej abbandunaw sekli ilu reġa' lura, b'isem ġdid: "tagħlim tal-magni".
Dipendenza fuq id-Dejta tat-Taħriġ:
L-AI titgħallem mill-eżempji. Jekk l-eżempji huma preġudikati, l-AI hija preġudikata. Jekk l-eżempji huma mhux kompluti, l-AI għandha blind spots. Jekk l-eżempji huma żbaljati, l-AI hija żbaljata.
Ħmieġ ġewwa, ħmieġ barra. Iżda għal sistemi kritiċi għas-sigurtà, "ħmieġ" ifisser ħsara. Deċiżjonijiet ta' self preġudikati. Ċaħdiet ta' impjiegi inġusti. Dijanjożi mediċi żbaljati.
Fraġilità:
L-AI teċċella fuq inputs familjari. Tfalli b'mod spettakolari fuq dawk mhux familjari. Bidliet żgħar fl-input jikkawżaw bidliet kbar fl-output. Din hija vulnerabbiltà avversarja.
Żid storbju imperċettibbli ma' immaġni. Il-mudell jikklassifika ħażin għal kollox. Dan mhux teoretiku. Ġie ttestjat. Ippruvat. Riproduċibbli. L-AI attwali hija fraġli.
Ebda Sens Komuni:
L-AI m'għandha l-ebda fehim. L-ebda mudell tad-dinja. L-ebda sens komuni. Taqbel mudelli ta' informazzjoni. Kultant b'mod brillanti. Kultant b'mod katastrofikament ħażin.
Itlobha affarijiet impossibbli, xorta tipprova. Itlobha affarijiet ta' ħsara, tista' tikkonforma. Ma tifhimx. Tipproċessa biss inputs.
Dan iwassal għal fallimenti spettakolari li jkunu umoristiċi kieku ma kinux qed jintużaw f'sistemi kritiċi. AI medika tiddijanjostika b'kunfidenza pazjenti b'mard li ma jeżistix għax ix-xejra tas-sintomi qabbel mat-tagħrif tat-taħriġ. Vetturi awtonomi jieqfu għal kaxxi tal-posta miżbubin biex jixbhu sinjali ta' waqfien, rikonoxximent ta' mudelli teknikament korrett, fehim katastrofikament ħażin. AI legali tiċċita każistika kompletament ivvintata għax il-format taċ-ċitazzjoni qabbel ma' dak li tgħallmet. Staqsi tifel ta' tliet snin jekk tistax tieħu n-nifs taħt l-ilma, jgħidlek le. Staqsi lill-AI attwali, tista' tiġġenera esejs konvinċenti li jispjegaw tekniki ta' nifs taħt l-ilma, mingħajr ebda fehim li huwa fiżikament impossibbli, biss tqabbil ta' mudelli minn xjenza finzjoni li fuqha ġiet imħarrġa.
Fallimenti ta' sigurtà fid-dinja reali
Dawn mhumiex ipoteżi. Ġraw:
- Ħabtiet ta' Vetturi Awtonomi: L-AI naqset li tirrikonoxxi persuni mexjin f'ċerti kundizzjonijiet. Dawl. Ħwejjeġ. Kuntest. Nies mietu. L-AI ottimizzat għal każijiet medji, naqset fuq każijiet estremi.
- Preġudizzju fir-Rikonoxximent tal-Wiċċ: Rati ta' żbalji ogħla għan-nisa u l-minoranzi. Għaliex? It-tagħrif tat-taħriġ kien predominantement irġiel bojod. Il-preġudizzju fid-dejta sar preġudizzju fid-deċiżjonijiet. Diskriminazzjoni fid-dinja reali awtomatizzata.
- Żbalji fl-AI Medika: L-AI tirrakkomanda trattamenti ħżiena. Titlef dijanjosi. Għaliex? Imħarrġa fuq dejta minn sptarijiet speċifiċi. Ma ġeneralizzatx għal popolazzjonijiet jew kundizzjonijiet differenti. Ottimizzazzjoni għal metriċi, mhux għar-riżultati tal-pazjenti.
- Fallimenti fil-Moderazzjoni tal-Kontenut: L-AI tneħħi kontenut leġittimu. Titlef kontenut ta' ħsara. Il-kuntest jgħodd. Is-sfumatura tgħodd. L-AI tissielet ma' tnejn minnhom. Ċensura u abbuż, awtomatizzati.
F'kull każ, l-AI għamlet dak li kienet imħarrġa tagħmel. It-taħriġ kien insuffiċjenti. Ir-robustezza kienet nieqsa. L-ispeċifikazzjoni kienet ħażina. Fallimenti ta' sigurtà.
Eżempji Ewropej jolqtuk eqreb lejn id-dar. L-awtorità tat-taxxa Olandiża użat l-AI biex tiskopri frodi fil-benefiċċji tal-kura tat-tfal: l-algoritmu mmarka eluf ta' familji innoċenti, ħafna minnhom minn sfondi ta' immigranti, u wassal għal rovina finanzjarja għal xi wħud. L-ebda spjegazzjoni mogħtija. L-ebda rimedju disponibbli. Il-gvern Olandiż eventwalment ħallas kumpens ta' €30,000 għal kull familja, u l-kabinett kollu rriżenja. Fi Franza, sistema tal-AI użata għall-ammissjonijiet universitarji nstabet li tiddiskrimina abbażi tal-kunjomijiet, preferenzi kkodifikati b'mod espliċitu li ġraw jikkorrelataw mal-oriġini etnika. Fiż-żewġ każijiet: l-AI ħadmet eżattament kif kienet iddisinjata. Id-disinn kien il-problema.
X'jagħmel l-AI tassew sigura
Is-sigurtà teħtieġ saffi multipli. L-ebda soluzzjoni waħda:
Spjegabbiltà:
Għandek tkun tista' tara għaliex l-AI ħadet deċiżjoni. Mhux biss "in-netwerk newrali attiva." Raġunijiet attwali. Loġika traċċabbli. Passi verifikabbli.
Sistemi bbażati fuq il-kostrizzjonijiet jgħinu hawnhekk. Kull deċiżjoni ssegwi kostrizzjonijiet espliċiti. Tista' ssegwi r-raġunament. Tivverifika l-korrettezza. Tawditja d-deċiżjonijiet.
Ittestjar tar-Robustezza:
Ittestja lil hinn mid-dejta tat-taħriġ. Eżempji avversarji. Każijiet estremi. Testijiet tal-istress. Jekk jinkiser, issewwih qabel it-tqegħid fis-suq. Mhux wara l-ħsara.
Verifikazzjoni formali fejn possibbli. Provi matematiċi tal-imġiba. Ambitu limitat bħalissa, iżda qed jikber.
Il-korpi Ewropej taċ-ċertifikazzjoni jitolbu din ir-rigorożità. It-TÜV mhux se jiċċertifika sistemi awtonomi mingħajr ittestjar estensiv tar-robustezza f'kull xenarju li wieħed jista' jimmaġina. Iċ-CNIL Franċiż jirrikjedi valutazzjonijiet tal-impatt fuq il-protezzjoni tad-dejta qabel it-tqegħid tal-AI fis-suq. Il-Garante Taljan jitlob awditjar algoritmiku għat-teħid ta' deċiżjonijiet awtomatizzati. Dan mhux burokrazija; huwa esperjenza miksuba. L-Ewropa rat biżżejjed kollass ta' pontijiet, ħsarat fil-bini, u inċidenti industrijali biex tkun taf li "jaħdem il-biċċa l-kbira tal-ħin" mhux biżżejjed għal sistemi kritiċi għas-sigurtà. L-istess standards issa japplikaw għall-AI.
Superviżjoni Umana:
L-AI tipproponi. Il-bniedem jiddeċiedi. Speċjalment għal deċiżjonijiet ta' riskju għoli. Dijanjosi medika, approvazzjoni ta' self, ġudizzji legali. Il-bniedem fiċ-ċiklu huwa obbligatorju.
Mhux "l-AI tiddeċiedi u l-bniedem japprova b'mod awtomatiku." Il-bniedem fil-fatt jirrevedi. Għandu għodod biex jifhem. Jista' jibdel id-deċiżjoni.
Ir-regolaturi finanzjarji Ewropej tgħallmu dan bl-iebes waqt il-kriżi tal-2008: sistemi ta' kummerċ awtomatizzat mingħajr superviżjoni umana suffiċjenti kkawżaw ħabtiet f'daqqa. Issa r-regolamenti finanzjarji tal-UE jirrikjedu superviżjoni umana sinifikanti għal deċiżjonijiet awtomatizzati. "Sinifikanti" tfisser li l-bniedem għandu informazzjoni suffiċjenti, ħin suffiċjenti, u awtorità suffiċjenti biex fil-fatt jintervjeni. Bniedem li jikklikkja "approva" kull tliet sekondi fuq deċiżjonijiet ta' self tal-AI mhux superviżjoni; huwa teatru. Ir-regolaturi Ewropej jiċċekkjaw dan: jawditjaw il-ħin tad-deċiżjonijiet, ir-rati ta' tibdil, u jekk il-bnedmin għandhomx għodod attwali biex jifhmu r-raġunament tal-AI. Superviżjoni li ma tistax tipprevjeni problemi mhix superviżjoni.
Tqegħid Gradwali:
Tqegħidx kullimkien immedjatament. Ibda żgħir. Immonitorja mill-qrib. Espandi gradwalment. Aqbad il-problemi kmieni meta l-istakes huma baxxi.
Ittestjar A/B. Tqegħid ta' kanarji. Rilaxx progressiv. Prattiki tal-inġinerija tas-softwer applikati għas-sigurtà tal-AI.
Monitoraġġ Kontinwu:
L-AI fil-produzzjoni teħtieġ monitoraġġ kostanti. Metriċi tal-prestazzjoni. Rati ta' żbalji. Kontrolli tal-preġudizzju. Sejbien ta' drift.
Daxxijiet f'ħin reali. Twissijiet awtomatiċi. Rispons rapidu għall-problemi. Is-sigurtà mhix ħaġa ta' darba. Hija kontinwa.
Sistemi ta' restrizzjonijiet binarji u s-sigurtà
Arkitetturi differenti tal-AI għandhom proprjetajiet ta' sigurtà differenti:
- Netwerks Newrali (Floating-Point): Opaki. Diffiċli biex jiġu vverifikati. Kwistjonijiet ta' fraġilità. Vulnerabbiltà avversarja. Sigurtà permezz ta' ttestjar estensiv u tama.
- Sistemi Bbażati fuq Restrizzjonijiet (Bħal Dweve Loom): Trasparenti. Restrizzjonijiet espliċiti. Raġunament traċċabbli. Kull deċiżjoni ssegwi regoli loġiċi. Verifikabbli bid-disinn.
Ma ssolvix il-kwistjonijiet kollha ta' sigurtà. Iżda l-ispjegabbiltà tgħin bil-kbir. Tista' tara għaliex ittieħdu d-deċiżjonijiet. Ivverifika li r-restrizzjonijiet huma korretti. Issolvi kwistjonijiet speċifiċi mingħajr ma terġa' tħarreġ kollox.
L-operazzjonijiet binarji jipprovdu determinism. L-istess inputs, l-istess outputs. Riproduċibbli. Ittestjabbli. Verifikabbli.
X'tista' tagħmel (passi prattiċi)
Bħala xi ħadd li juża l-AI jew li huwa affettwat minnha:
- 1. Itlob Spjegabbiltà: Staqsi għaliex l-AI ħadet deċiżjoni. Jekk ma jistgħux jispjegaw, dik hija bandiera ħamra.
- 2. Iċċekkja għall-Ittestjar tal-Bias: L-AI ġiet ittestjata fuq popolazzjonijiet diversi? X'inhu r-rata ta' żball għal gruppi differenti?
- 3. Fittex għal Superviżjoni Umana: Il-bnedmin qed jirrevedu d-deċiżjonijiet? Għandhom setgħa reali biex jibdluhom?
- 4. Ifhem il-Limitazzjonijiet: F'liema xenarji huwa magħruf li l-AI tonqos? Dawk huma dokumentati? Ikkomunikati?
- 5. Ivverifika l-Implimentazzjoni Gradwali: Dan ġie implimentat b'attenzjoni? Jew jitfa' fil-produzzjoni kullimkien f'daqqa?
- 6. Immonitorja għall-Kwistjonijiet: Hemm monitoraġġ kontinwu? Kemm malajr jirrispondu għall-problemi?
- 7. Konformità Regolatorja: Jissodisfa l-istandards regolatorji (EU AI Act, eċċ.)? Hemm responsabbiltà?
Int għandek is-setgħa. Użaha. Itlob AI sigura. Tlaqqax "afda fina, hija AI" bħala tweġiba.
L-ispiża ekonomika tal-AI mhux sigura
Il-fallimenti tas-sigurtà mhumiex biss problemi etiċi; huma diżastri finanzjarji. Il-kumpaniji Ewropej tgħallmu dan bl-ispiża.
Spejjeż Diretti:
L-iskandlu tal-benefiċċji tat-tfal fl-Olanda swa lill-kontribwenti aktar minn €1 biljun f'kumpens. Air France ffaċċjat multi ta' €800,000 meta s-sistema tagħhom ta' b'ordinarju ta' rikonoxximent tal-wiċċ iddiskriminat kontra l-passiġġieri. L-assiguraturi tas-saħħa Ġermaniżi ħallsu miljuni f'penali meta deċiżjonijiet ta' talbiet ibbażati fuq l-AI kisru r-regolamenti tal-privatezza medika.
Dawn mhumiex każijiet marġinali. Dawn huma dak li jiġri meta tiskjera l-AI mingħajr verifikazzjoni tas-sikurezza.
Spiżi ta' Opportunità:
Banek Brittaniċi warrbu sistemi ta' self bl-AI wara skandli ta' preġudizzju: snin ta' żvilupp, miljuni investiti, abbandunati għax is-sikurezza ma ngħatatx prijorità mill-bidu. Sptarijiet Spanjoli waqqfu d-dijanjosi bl-AI meta l-awdituri ma setgħux jivverifikaw il-proċessi tat-teħid tad-deċiżjonijiet. Aġenziji tal-gvern Svediż rrevokaw pjanijiet ta' awtomazzjoni meta ma setgħux juru konformità mal-GDPR.
Il-bini darbtejn (darba ħażin, darba sewwa) jiswa aktar milli tibnih sewwa mill-ewwel. L-uffiċjali tax-xiri Ewropej jifhmu dan. Il-kapitalisti ta' riskju Amerikani qed jitgħallmuh.
Multi Regolatorji:
Il-ksur tal-Att dwar l-AI tal-UE iġorr multi sa €35 miljun jew 7% tal-fatturat annwali globali, skont liema jkun ogħla. Il-GDPR diġà wera r-rieda tal-Ewropa li tinforza: €1.6 biljun f'multi maħruġa fl-2023 biss. Kumpaniji li jqisu s-sikurezza tal-AI bħala fakultattiva qed jiskopru li hija obbligatorja.
Il-matematika hija sempliċi: l-investiment fis-sikurezza minn qabel jiswa inqas milli tirranġa l-fallimenti wara. Il-kumpaniji Ewropej tgħallmu dan permezz ta' esperjenza bl-uġigħ. Issa jitolbuh mill-bidu.
Approċċi kulturali għas-sikurezza tal-AI
L-approċċi Ewropej u Amerikani għas-sikurezza tal-AI jiddifferixxu fundamentalment, mhux biss fir-regolamentazzjoni, iżda fil-filosofija tal-inġinerija.
L-Approċċ ta' Silicon Valley:
Mexxi malajr, kisser l-affarijiet, itera. Skjera l-ewwel, irranġa l-problemi wara. Is-sikurezza hija karatteristika li żżid wara li tikseb product-market fit. Ir-rata ta' falliment aċċettabbli hija kwalunkwe ħaġa li l-utenti jittolleraw. Il-veloċità tal-innovazzjoni tegħleb il-validazzjoni bir-reqqa. Itlob maħfra, mhux permess.
Dan jaħdem għal applikazzjonijiet tal-web. Ikklikkja l-buttuna ħażina, erġa' tagħbija l-paġna. Iżda dijanjosi medika? Vetturi awtonomi? Deċiżjonijiet finanzjarji li jaffettwaw il-ħajjiet? Li tkisser l-affarijiet ifisser li tweġġa' lin-nies.
L-Approċċ tal-Inġinerija Ewropea:
Kejjel darbtejn, aqta' darba. Ivvalida qabel l-iskjerament. Is-sikurezza hija arkitettonika, mhux fakultattiva. Ir-rata ta' falliment aċċettabbli hija determinata mir-riskju, mhux mit-tolleranza tal-utent. Il-validazzjoni bir-reqqa tippermetti innovazzjoni sostenibbli. Il-permess mhuwiex burokrazija; huwa responsabbiltà.
Dan ġej minn sekli ta' inġinerija fiżika. Pontijiet li jikkrollaw. Bini li jfalli. Trattamenti mediċi li jagħmlu ħsara. Il-kultura tal-inġinerija Ewropea tgħallmet dawn il-lezzjonijiet permezz ta' esperjenza traġika. L-istess prinċipji issa japplikaw għas-sistemi diġitali.
L-Ironija:
Il-kumpaniji Amerikani spiss jerġgħu jibnu sistemi tal-AI biex jissodisfaw l-istandards Ewropej, imbagħad jiskopru li l-verżjoni aktar sikura taħdem aħjar globalment. L-AI spjegabbli mhijiex biss konformità regolatorja; tgħin biex tidentifika u tirranġa l-problemi aktar malajr. L-ittestjar robust jaqbad il-bugs qabel ma jagħmluh l-utenti. Is-superviżjoni umana tipprevjeni fallimenti kaskata.
Is-sikurezza mhijiex l-oppost tal-innovazzjoni. Hija dak li tippermetti innovazzjoni sostenibbli. L-Ewropej ma vvintawx din l-idea; huma biss ftakruha meta Silicon Valley nesiet.
Triqat prattiċi għal sistemi tal-AI aktar sikuri
Il-moviment minn AI mhux sikura għal waħda sikura jeħtieġ bidliet tekniċi konkreti, mhux biss politika:
Għażla tal-Arkitettura skont ir-Riskju:
Ieqaf tuża l-istess arkitettura għal kollox. Deċiżjonijiet ta' riskju għoli jeħtieġu sistemi verifikabbli. Dijanjosi medika, deċiżjonijiet finanzjarji, vetturi awtonomi: dawn jeħtieġu AI spjegabbli u awditabbli. Sistemi bbażati fuq restrizzjonijiet, raġunament simboliku, approċċi ibridi li jgħaqqdu netwerks newrali ma' regoli loġiċi.
Applikazzjonijiet ta' riskju baxx (rakkomandazzjonijiet ta' kontenut, filtri tal-immaġini, AI tal-logħob) jistgħu jittolleraw kaxxi suwed. Iżda r-Regolament Ewropew dwar Apparat Mediku jeħtieġ espliċitament li s-softwer li jieħu deċiżjonijiet dijanjostiċi jrid ikun spjegabbli. Agħżel l-arkitettura bbażata fuq il-konsegwenzi tal-falliment.
It-Testjar Adversarjali (Red-Teaming):
Qabel it-tqegħid fis-suq, ikri nies biex ikissru l-AI tiegħek. Mhux riċerkaturi tas-sigurtà, imma esperti reali fil-qasam li jifhmu kif is-sistema se tintuża u tiġi abbużata. Il-banek Ewropej issa jirrikjedu ttestjar adversarjali tas-sistemi tal-kreditu tal-AI qabel l-approvazzjoni regolatorja. Il-kumpaniji tal-karozzi Ġermaniżi jimpjegaw ittestjaturi adversarjali li jqattgħu xhur ifittxu każijiet estremi li fuqhom is-sistemi awtonomi jfallu.
Dan mhux għali meta mqabbel mal-fallimenti wara t-tqegħid fis-suq. Xahar wieħed ta' red-teaming jiswa inqas minn ġurnata waħda ta' multi regolatorji jew kawża waħda minn ħsara kkawżata mill-AI.
It-Tqegħid Gradwali tal-Kapaċitajiet:
Ibda bl-assistenza tal-AI, mhux bl-awtonomija tal-AI. Issuġġerixxi, tiddeċidix. Uri r-raġunament, irrikjedi konferma mill-bniedem. Żid l-awtonomija gradwalment biss wara li turi s-sigurtà f'kull livell.
L-isptarijiet Daniżi jqiegħdu l-AI dijanjostika b'dan il-mod: l-ewwel bħala għodda ta' tieni opinjoni, imbagħad bħala skrinjar primarju biss għal każijiet ta' riskju baxx, u fl-aħħar bħala dijanjosi awtonoma għal kundizzjonijiet validati speċifiċi. Kull pass ippruvat sikur qabel ma jitwessa' l-ambitu. Qabbel dan ma' sistemi mqiegħda b'awtonomija sħiħa immedjatament: il-fallimenti huma prevedibbli.
Verifiki tas-Sigurtà Obbligatorji:
Verifiki esterni, mhux ittestjar intern. Ir-regolaturi Ewropej dejjem aktar jirrikjedu verifiki tal-AI minn partijiet terzi għal sistemi ta' riskju għoli. L-awtorità Awstrijaka tal-protezzjoni tad-dejta timponi valutazzjonijiet tal-impatt algoritmiku qabel it-tqegħid fis-suq. Il-korpi taċ-ċertifikazzjoni Franċiżi jivverifikaw it-teħid ta' deċiżjonijiet tal-AI fis-servizzi pubbliċi.
L-awdituri indipendenti jsibu problemi li t-timijiet interni jitilfu. Mhux inkompetenza, imma għajnejn ġodda u l-ebda pressjoni organizzattiva biex jiddikjaraw li l-affarijiet huma sikuri.
Klawsoli ta' Skadenza għas-Sistemi tal-AI:
Is-sistemi tal-AI m'għandhomx jitħaddmu b'mod indefinit mingħajr validazzjoni mill-ġdid. Id-dejta tinbidel. Il-popolazzjonijiet jinbidlu. Jitfaċċaw każijiet estremi. Il-kuntratti tal-akkwist pubbliku Ewropej dejjem aktar jinkludu perjodi obbligatorji ta' validazzjoni mill-ġdid: kull 12-24 xahar, ipprova li s-sistema għadha taħdem sew jew titwaqqaf.
Dan jipprevjeni l-problema ta' "tqegħid u minsija" fejn sistemi tal-AI ottimizzati għad-dejta tal-2020 għadhom jieħdu deċiżjonijiet fl-2025, b'riżultati prevedibbilment ħżiena.
Il-futur tas-sigurtà tal-AI
Ir-riċerka dwar is-sigurtà hija attiva. Qed titjieb. Diversi direzzjonijiet:
- AI Kostituzzjonali: Taħriġ tal-AI b'regoli espliċiti. Restrizzjonijiet kostituzzjonali fuq l-imġiba. Mhux biss tagħlim minn eżempji.
- Interpretabbiltà Mekkanistika: Nifhmu n-netwerks newrali f'livell aktar profond. Mhux biss inputs/outputs. Mekkaniżmi interni. Għadha kmieni imma promettenti.
- Verifikazzjoni Formali: Provi matematiċi tal-imġiba tal-AI. Ambitu limitat issa. Qed tespandi gradwalment. L-istandard tad-deheb għal garanziji ta' sigurtà.
- Taħriġ Adversarjali: Taħriġ fuq eżempji adversarjali. Nagħmlu l-mudelli reżistenti għall-manipulazzjoni. Tellieqa kontinwa tal-armi imma l-progress huwa reali.
- Standards tas-Sigurtà tal-AI: IEEE, ISO, korpi governattivi. Ħolqien ta' standards għas-sigurtà tal-AI. Il-konformità qed issir obbligatorja.
- Riċerka Ewropea dwar is-Sigurtà tal-AI: L-istituzzjonijiet Ewropej imexxu fl-AI li tagħti prijorità lis-sigurtà. CLAIRE (Confederation of Laboratories for Artificial Intelligence Research in Europe) espliċitament tagħti prijorità lill-AI affidabbli fuq il-benchmarks tal-prestazzjoni. L-istituti tar-riċerka Ġermaniżi jiffokaw fuq AI ċertifikabbli: sistemi fejn is-sigurtà tista' tiġi ppruvata, mhux biss ittestjata. L-INRIA Franċiż jiżviluppa tagħlim tal-magni verifikat formalment. L-universitajiet Olandiżi jirriċerkaw algoritmi konxji tal-bias fid-disinn. Prijoritajiet differenti minn dawk ta' Silicon Valley ta' "move fast and break things". L-approċċ Ewropew: imxi b'attenzjoni u ipprova li jaħdem.
Is-sigurtà qed titjieb. Imma t-tqegħid fis-suq spiss jaqbeż lis-sigurtà. Id-distakk huwa ta' tħassib.
L-approċċ regolatorju tal-Ewropa, li jitlob is-sikurezza qabel it-tqegħid fis-suq minflok ma jiskuża ruħu wara l-ħsara, jirrappreżenta filosofija fundamentalment differenti. Il-kumpaniji tat-teknoloġija Amerikani qiesu l-Att dwar l-IA tal-UE bħala ostaklu għall-innovazzjoni. L-inġiniera Ewropej qiesuh bħala kodifikazzjoni ta' dak li kellu jkun prattika standard sa mill-bidu. Id-differenza bejn l-inġinerija u l-intraprenditorija: l-inġiniera ma jaqsdux pont ikklassifikat għal 10 tunnellati b'trakk ta' 11-il tunnellata, tkun kemm tkun kbira l-kunfidenza tagħhom.
Dak li għandek tiftakar
- 1. Is-sikurezza tal-IA hija dwar problemi reali u attwali. Mhux fantaxjenza. Preġudizzju, żbalji, fraġilità. Qed jiġru issa.
- 2. L-IA attwali mhijiex intrinsikament sikura. Kaxxi suwed. Dipendenti fuq id-dejta. Fraġli. Mingħajr sens komun. Is-sikurezza teħtieġ inġinerija attiva.
- 3. Is-sikurezza teħtieġ saffi multipli. Spjegabbiltà, ittestjar, superviżjoni, monitoraġġ. L-ebda soluzzjoni waħda. Difiża fil-fond.
- 4. L-arkitettura hija importanti għas-sikurezza. Sistemi trasparenti jippermettu l-verifikazzjoni. Restrizzjonijiet binarji jipprovdu determinism. Agħżel l-arkitettura skont il-każ ta' użu.
- 5. Tista' titlob IA aktar sikura. Staqsi mistoqsijiet. Itlob spjegazzjonijiet. Iċċekkja għal superviżjoni. Uża l-poter tiegħek bħala utent/klijent.
- 6. Is-sikurezza hija kontinwa, mhux ta' darba waħda. Monitoraġġ kontinwu. Reazzjonijiet rapidi. Titjib adattiv. Qatt "lesta."
- 7. Il-progress qed iseħħ. Riċerka attiva. Standards qed joħorġu. Iżda t-tqegħid fis-suq spiss jaqbeż is-sikurezza. Kun konxju.
Il-qofol
Is-sikurezza tal-IA mhijiex dwar kif nipprevjenu lill-robots milli jieħdu l-poter. Hija dwar kif niżguraw li s-sistemi tal-IA tal-lum jaħdmu b'mod korrett, ġust u trasparenti. Prevenzjoni tal-ħsara, mhux fantaxjenza.
L-IA attwali għandha problemi reali ta' sikurezza. Opakità. Preġudizzju. Fraġilità. Dawn jikkawżaw ħsara reali. Lil nies reali. Proprju issa.
IA aktar sikura hija possibbli. Permezz ta' ittestjar aħjar. Arkitetturi spjegabbli. Superviżjoni umana. Monitoraġġ kontinwu. Hija inġinerija, mhux maġija.
Approċċi differenti għandhom proprjetajiet differenti ta' sikurezza. Sistemi bbażati fuq restrizzjonijiet joffru trasparenza. Netwerks newrali joffru kapaċità. Agħżel abbażi tar-rekwiżiti ta' sikurezza, mhux biss tal-prestazzjoni.
Int għandek il-poter. Itlob is-sikurezza. Itlob l-ispjegabbiltà. Insisti fuq is-superviżjoni. Tlaqqax sistemi opaki għal deċiżjonijiet ta' riskju għoli. Sikurezza permezz tar-responsabbiltà.
Il-futur tal-AI jiddependi fuq is-soluzzjoni tas-sikurezza. Mhux tal-prestazzjoni. Il-prestazzjoni diġà impressjonanti. Is-sikurezza qed tibqa' lura. Agħlaq dak id-distakk, u l-AI ssir tassew siewja. Ħallih miftuħ, u l-AI tibqa' riskju.
Ir-regolaturi Ewropej ma ħolqux dawn ir-rekwiżiti ta' sikurezza biex jipproteġu lill-kumpaniji Ewropej; ħolquhom biex jipproteġu liċ-ċittadini Ewropej. Iżda ħareġ effett sekondarju interessanti: kumpaniji li jibnu l-AI skont l-istandards ta' sikurezza Ewropej skoprew li s-sistemi tagħhom ħadmu aħjar kullimkien. Deċiżjonijiet spjegabbli li l-utenti jistgħu jifhmu u jafdaw. Sistemi robusti li jittrattaw każijiet estremi. Raġunament verifikabbli li jaqbad l-iżbalji qabel it-tnedija. Jirriżulta li s-sikurezza u l-kwalità huma marbutin mill-qrib.
L-industrija tal-AI tiffaċċja għażla: tirreżisti r-rekwiżiti ta' sikurezza bħala regolamentazzjoni tqila, jew tilqagħhom bħala prattika tajba tal-inġinerija. Il-kumpaniji Ewropej diġà għamlu dik l-għażla. Il-kumpaniji Amerikani qed jitgħallmu, kultant permezz ta' multi regolatorji ta' biljuni ta' dollari, kultant permezz ta' fallimenti katastrofiċi, u kultant billi jaqraw il-letteratura tal-inġinerija minn industriji li solviet is-sikurezza għexieren ta' snin ilu.
Is-sikurezza mhijiex dwar il-biża' mill-AI. Hija dwar li l-AI tkun ta' min jużaha. Sistemi li tista' tafda. Deċiżjonijiet li tista' tivverifika. Teknoloġija li tgħin mingħajr ma tagħmel ħsara. Dik mhijiex piż regolatorju; dak huwa l-għan kollu tal-bini tal-AI fl-ewwel lok.
Tixtieq AI intrinsikament aktar sikura? Esplora Dweve Loom. Restrizzjonijiet binarji jipprovdu raġunament espliċitu u verifikabbli. Kull deċiżjoni traċċabbli permezz ta' regoli loġiċi. Imġiba deterministika. It-tip ta' AI fejn is-sikurezza mhijiex ħsieb ta' wara, iżda hija arkitettonika.