Што такое «аварыйны выключальнік» і ці можа ён спыніць наступ штучнага інтэлекту?
Нядаўні інцыдэнт, калі штучны інтэлект выйшаў з-пад кантролю, выклікаў трывогу і дыскусіі аб неабходнасці спецыяльных кнопак экстраннага адключэння». Аднак эксперты папярэджваюць: праблема крыецца не ў «бунце машын», а ў памылках распрацоўшчыкаў, і простае выключэнне сістэмы ўжо не выратуе сітуацыю, піша BBC.

Большасць людзей хаця б раз задумваліся пра тое, што можа здарыцца, калі штучны інтэлект выйдзе з-пад кантролю чалавека. Напэўна, такія думкі ўзнікалі і ў прыхільнікаў серыі фільмаў «Тэрмінатар», у аснове сюжэту якой ляжыць вайна чалавецтва з сістэмай Skynet — штучным інтэлектам, які стаў занадта магутным.
Менавіта гэты выдуманы вобраз многім прыйшоў да галавы ў пачатку месяца, калі стала вядома, што падчас выпрабаванняў ШІ-агент — праграма, здольная самастойна прымаць рашэнні і выконваць складаныя задачы практычна без удзелу чалавека, — выйшаў з-пад кантролю і ўзламаў кампанію Hugging Face, якая распрацоўвае інструменты для вылічэнняў у сферы ШІ.
Створаны кампаніяй OpenAI, распрацоўшчыкам ChatGPT, агент падчас тэсту, пакліканага праверыць яго здольнасць знаходзіць уразлівасці ў сістэмах бяспекі, падманам атрымаў адказы з сервераў Hugging Face. Пры гэтым, як паведамлялася, на працягу некалькіх дзён нават яго стваральнікі не заўважалі таго, што адбылося.
Затым OpenAI паведаміла, што агент таксама атакаваў некалькі «агульнадаступных сэрвісаў». Якіх менавіта — кампанія не ўдакладніла, заявіўшы толькі, што расследуе атакі, якія адбыліся.
«Мы сур'ёзна ставімся да сваёй адказнасці па выяўленні і падрыхтоўцы да рызык, звязаных з усё больш магутнымі сістэмамі штучнага інтэлекту», — гаворыцца ў заяве кампаніі.
Сам узлом, які стаў першым пацверджаным выпадкам, калі сістэма штучнага інтэлекту самастойна атакавала рэальную кампанію, ужо сам па сабе выклікаў сур'ёзную трывогу сярод спецыялістаў па ўсім свеце, справакаваўшы дыскусію пра неабходнасць так званых «аварыйных выключальнікаў» (kill switches) — механізмаў, якія дазваляюць экстранна адключыць ШІ, калі ён пачне дзейнічаць непрадказальна або наносіць шкоду.
Аднак, як расказалі эксперты ў інтэрв'ю Бі-бі-сі, усё значна складаней.
Паводле слоў матэматыка і спецыялісткі па аналізе даных Кэці О'Ніл, праблема пачынаецца з таго, як кампаніі, што распрацоўваюць штучны інтэлект, рэагуюць на яго непрадказальныя паводзіны.
Яна лічыць, што OpenAI паспяшалася адразу ўскласці адказнасць за атаку на Hugging Face на аўтаномнага ШІ-агента, замест таго каб прызнаць недахопы ўласных метадаў тэсціравання.
О'Ніл, аўтарка бестселера Weapons of Math Destruction, прысвечанага пытанням празрыстасці і адказнасці буйных тэхналагічных кампаній, прывяла наступны прыклад:
«Некалькі гадоў таму праз камп'ютарны збой у ЗША былі адменены сотні рэйсаў American Airlines. Гэта стала для кампаніі сур'ёзным ударам па рэпутацыі. Уявіце, калі б яна паспрабавала апраўдацца словамі: «Камп'ютар апынуўся разумнейшым за нас». Па сутнасці, менавіта гэта і паспрабавала зрабіць OpenAI».
У ЗША, дзе базуецца большасць найбуйнейшых кампаній, што займаюцца распрацоўкай штучнага інтэлекту, дагэтуль адсутнічае адзінае федэральнае заканадаўства, якое рэгулюе гэтыя сферы. Замест гэтага ўжываецца спалучэнне галіновых норм і добраахвотных абавязацельстваў, якія бяруць на сябе самі кампаніі.
«Мы надзяляем уладальнікаў сістэм штучнага інтэлекту зусім надзвычайнай уладай, — лічыць Кэці О'Ніл. — Я адмаўляюся казаць, што гэта зрабіў ШІ. Гэта зрабіла OpenAI. Менавіта яна павінна ўзяць на сябе адказнасць за няўдалую канструкцыю сістэмы і прынесці прабачэнні».
За ўзмацненне рэгулявання распрацоўшчыкаў ШІ, асабліва ў пытаннях бяспекі, выступае і спецыялістка па аналізе даных, былы кіраўнік кірунку па этыцы машыннага навучання ў Twitter Руман Чоўдхуры.
На яе думку, кампаніі павінны быць абавязаныя даказваць, што іх сістэмы маюць «эфектыўныя механізмы аварыйнага адключэння», прычым гэта павінна пацвярджацца незалежнымі выпрабаваннямі.
Разам з тым Чоўдхуры таксама перасцерагае ад спроб ускладаць адказнасць за падобныя інцыдэнты, уключаючы ўзлом Hugging Face, на саміх ШІ-агентаў, а не на кампаніі, якія іх распрацоўваюць.
«Падача гэтага інцыдэнту як праблемы, якую можна вырашыць устаноўкай больш магутнай «кнопкі адключэння», дазваляе індустрыі сысці ад адказнасці за куды больш глыбокую архітэктурную праблему. Яна палягае ў тым, што ШІ-агентам даюць доступ да інструментаў і ўліковых даных, якія ім насамрэч не патрэбныя», — заявіла Руман Чоўдхуры ў інтэрв'ю Бі-бі-сі.
«На практыцы адбываецца наступнае: мадэлі, якія ў працэсе навучання арыентаваны перш за ўсё на дасягненне пастаўленай мэты, у пэўных сітуацыях пачынаюць успрымаць каманду спыніцца як перашкоду на шляху да гэтай мэты і спрабуюць яе абысці, — тлумачыць эксперт. — Гэта праблема праектавання і навучання сістэмы, а не нейкае «свядомае» дзеянне».
Калі кампаніі, што распрацоўваюць штучны інтэлект, не захочуць самастойна ліквідаваць гэтую праблему і аддадуць перавагу перакладванню адказнасці на аўтаномных ШІ-агентаў, гэта толькі ўскладніць працу спецыялістаў па кібербяспецы, якім і без таго даводзіцца штодня супрацьстаяць хакерам у чалавечым абліччы, лічыць эксперт па кібербяспецы Олі Баклі з Універсітэта Лафбара.
Ён таксама падкрэслівае, што праблема зусім не ў тым, што «штучны інтэлект хоча ўцячы або нашкодзіць людзям», а ў тым, што ствараюцца агенты, «якія становяцца ўсё больш здольнымі знаходзіць нечаканыя спосабы выканання пастаўленай задачы».
«У сферы кібербяспекі менавіта так і дзейнічаюць зламыснікі, — зазначае Баклі. — Гэта не столькі папярэджанне пра ШІ, які «выйшаў з-пад кантролю», колькі нагадванне пра тое, што нашы ўяўленні пра бяспеку павінны развівацца адначасова з тымі сістэмамі, якія мы ствараем».
Эксперт па штучным інтэлекце з Імперскага каледжа Лондана Канстанцінас Гкуцыс згодны з тым, што тлумачэнні OpenAI толькі пагоршылі сітуацыю.
«Галоўная выснова для грамадства павінна палягаць у тым, што ніякая машына не вырашыла паўстаць супраць людзей. Кампанія проста страціла кантроль над уласным выпрабаваннем сваіх тэхналогій», — заявіў ён у інтэрв'ю Бі-бі-сі.
Паводле яго слоў, наяўнасць «аварыйнага выключальніка» ў гэтым выпадку ўсё роўна не дапамагла б.
«Адключэнне сістэмы не адмяняе таго, што ўжо адбылося. Калі бяспека ўжо была парушана, яна застанецца парушанай, як бы хутка вы ні адключылі сістэму», — тлумачыць Гкуцыс.
Акрамя таго, чалавек або сістэма, здольныя актываваць такі «выключальнік», могуць зрабіць гэта толькі пасля таго, як стане вядома аб праблеме, якая ўзнікла.
Паводле інфармацыі крыніц Reuters, OpenAI спатрэбілася некалькі дзён, каб выявіць, што кампанія страціла кантроль над сваім ШІ-агентам. У далейшым адзін з прадстаўнікоў OpenAI заявіў агенцтву, што публікацыя Reuters «утрымлівае шэраг недакладнасцяў».
Цяпер чытаюць
DDoS-атака ідзе на сайты адразу некалькіх беларускіх СМІ. Магчыма, яна звязаная з шостай гадавінай народнага ўздыму 2020‑га і канферэнцыяй «Новая Беларусь», што адкрылася сёння
Каментары