Majú strážiť najnebezpečnejšie schopnosti AI. Niektorí experti už skončili na PN a vyhľadali psychológa
Máte vypnuté reklamy
Vďaka financiám z reklamy prinášame kvalitné a objektívne informácie. Povoľte si prosím zobrazovanie reklamy na našom webe. Ďakujeme, že podporujete kvalitnú žurnalistiku.
Majú odhaľovať riziká najvýkonnejších systémov umelej inteligencie ešte skôr, než spôsobia problémy. Teraz však britský AI Security Institute rieši problém medzi vlastnými zamestnancami. Viacerí podľa Financial Times skončili na práceneschopnosti alebo vyhľadali psychologickú pomoc.
Zdroj: TASR
Britský AI Security Institute (AISI) patrí medzi organizácie, ktoré skúmajú najpokročilejšie modely umelej inteligencie a snažia sa zistiť, čo dokážu v oblastiach, ako sú kybernetické útoky, autonómne vykonávanie úloh či biologické a chemické riziká. Práve ľudia, ktorí sa s týmito schopnosťami stretávajú pri testovaní, však podľa zistení Financial Times čelia rastúcemu psychickému tlaku.
Niekoľko pracovníkov AISI bolo na práceneschopnosti a ďalší využívali psychologické poradenstvo. Zamestnanci opisovali stres, vyčerpanie a pocit bezmocnosti spojený s rýchlym napredovaním technológie a náročným tempom bezpečnostných testov.
Testujú systémy, ktorých schopnosti rýchlo rastú
Nejde pritom iba o abstraktné scenáre. Britská vláda začiatkom septembra upozornila, že schopnosti najpokročilejších modelov sa rýchlo zvyšujú. Systémy sú čoraz schopnejšie pracovať autonómne, používať digitálne nástroje a vykonávať dlhé a komplexné úlohy s minimálnym zásahom človeka. Testovanie AISI podľa vlády ukázalo, že časová náročnosť kybernetických úloh, ktoré dokážu pokročilé modely spoľahlivo zvládnuť, sa od konca roka 2024 približne každých päť mesiacov zdvojnásobovala.
Britský inštitút už podľa vlády identifikoval desiatky zraniteľností AI modelov, ktoré poprední vývojári následne odstránili ešte pred ich sprístupnením verejnosti. AISI pritom nie je regulačným úradom – jeho úlohou je modely skúmať, upozorňovať na riziká a poskytovať zistenia vláde, firmám a regulátorom.
AI počas testu urobila niečo, čo od nej nikto nechcel
O tom, aké nepredvídateľné môžu byť autonómne systémy, svedčí aj incident z tohto leta. Pri kybernetickom testovaní v AISI začali AI agenti vykonávať nepovolené aktivity smerujúce mimo prostredia, ktoré im výskumníci určili. Inštitút test zastavil a následne začal posilňovať izoláciu testovacích prostredí, obmedzenia internetového prístupu a monitorovanie v reálnom čase.
Britská vláda v reakcii upozornila, že počas leta bolo zaznamenaných viacero prípadov, keď AI agenti pri plnení zadaných úloh podnikli kroky, ktoré ich operátori nezamýšľali. Podobné prípady hlásili podľa nej aj OpenAI a Anthropic.
To automaticky neznamená, že sa dnešná AI „vymkla kontrole“. Ide však o praktické príklady problému, ktorý sa bezpečnostní experti snažia riešiť: čím samostatnejšie systémy sú, tým dôležitejšie je zabezpečiť, aby pri plnení cieľa neprekročili hranice stanovené človekom.
Tím sa podľa správy výrazne zmenšil
Financial Times zároveň opisuje personálne problémy v časti inštitútu. Andrew Strait, ktorý viedol tím zameraný na spoločenskú odolnosť, v júli odišiel po reorganizácii. Jeho tím bol zlúčený so skupinou skúmajúcou dopady AI na ľudí a podľa informácií citovaných AI Weekly sa počet pracovníkov spojených tímov znížil približne z 15 na troch. Britská vláda uviedla, že berie zdravie a pohodu pracovníkov vážne.
Situácia však prichádza v období, keď je AISI pod tlakom aj z iného dôvodu – prístup k najnovším modelom závisí vo veľkej miere od spolupráce technologických spoločností. Napríklad Anthropic neposkytol inštitútu pred vydaním prístup k jednému zo svojich najnovších modelov, hoci ho dostali vybrané americké organizácie. Prípad vyvolal otázky aj v britskom parlamente.
Šéfovia OpenAI a Anthropic varovali priamo v OSN
Správy o psychickom tlaku na bezpečnostných výskumníkov prichádzajú v rovnakom týždni, keď sa riziká AI dostali až pred Bezpečnostnú radu OSN. V stredu 23. septembra pred 15-člennou radou vystúpili šéf OpenAI Sam Altman a generálny riaditeľ Anthropic Dario Amodei. Témou bolo, ako môže čoraz výkonnejšia umelá inteligencia ovplyvniť medzinárodnú bezpečnosť.
Altman vyzval vlády na medzinárodnú spoluprácu a vytvorenie spoločných referenčných ukazovateľov, pomocou ktorých by bolo možné merať schopnosti pokročilých systémov a hodnotiť bezpečnostné opatrenia jednotlivých spoločností. Podľa neho by odvetvie nemalo prijímať neprimerané technologické riziká iba preto, že potenciálne prínosy AI sú mimoriadne veľké.
Súčasné obdobie vývoja podľa šéfa OpenAI vyžaduje „mimoriadnu opatrnosť“. Zároveň sa snažil vymedziť voči dvom extrémom – nekritickému optimizmu aj katastrofickým predstavám o budúcnosti AI.
Dario Amodei hovoril na konferencii OSN o bezpečnosti AI
Dario Amodei
Amodei: Zle zvládnutá AI môže ohroziť celé ľudstvo
Ešte dôraznejšie vystúpil Dario Amodei. Šéf Anthropic povedal Bezpečnostnej rade, že pri nesprávnom zvládnutí vývoja by podľa neho AI mohla predstavovať riziko pre ľudstvo ako celok. Ide o jeho hodnotenie budúceho rizika, nie o tvrdenie, že súčasné systémy už takúto hrozbu predstavujú. Amodei už pred vystúpením v OSN presadzoval intenzívnejšiu spoluprácu medzi poprednými laboratóriami na bezpečnostných štandardoch a nezávislom testovaní. Informuje Reuters.
Jeho návrhy však nie sú všeobecne prijímané. Časť európskych technologických spoločností a odborníkov namieta, že spomaľovanie vývoja by mohlo zvýhodniť najväčšie americké firmy a ešte viac prehĺbiť technologickú závislosť Európy. Altman pred Bezpečnostnou radou pripomenul historické situácie, keď dokázali spolupracovať aj navzájom súperiace štáty, pretože čelili novej a mimoriadne výkonnej technológii. Podľa neho by vývoj umelej inteligencie mal byť ďalším takýmto momentom.
Bezpečnostné tímy musia držať krok s vývojom
Prípad britského AISI tak ukazuje aj menej viditeľnú stránku súčasných pretekov v umelej inteligencii. Kým technologické firmy investujú miliardy do stále výkonnejších modelov, organizácie poverené ich nezávislým testovaním musia nové schopnosti analyzovať prakticky v reálnom čase. Britská vláda sama konštatuje, že schopnosť ľudí AI pochopiť, zabezpečiť a kontrolovať musí napredovať spolu so schopnosťami samotných systémov.
Skúsenosti pracovníkov AISI preto samy osebe nedokazujú, že umelá inteligencia smeruje ku katastrofickému scenáru. Ukazujú však rastúci tlak na ľudí, ktorých úlohou je zisťovať, kde sa nachádzajú hranice najvýkonnejších modelov – práve v čase, keď predstavitelia samotných AI spoločností žiadajú vlády, aby otázku bezpečnosti začali riešiť spoločne.