Наука и технологии22

Что такое «аварийный выключатель» и может ли он остановить наступление искусственного интеллекта?

Недавний инцидент, когда искусственный интеллект вышел из-под контроля, вызвал тревогу и дискуссии о необходимости специальных кнопок экстренного отключения». Однако эксперты предупреждают: проблема кроется не в «бунте машин», а в ошибках разработчиков, и простое выключение системы уже не спасет ситуацию, пишет BBC.

Иллюстрация: vecteezy.com

Большинство людей хотя бы раз задумывались о том, что может случиться, если искусственный интеллект выйдет из-под контроля человека. Наверное, такие мысли возникали и у поклонников серии фильмов «Терминатор», в основе сюжета которой лежит война человечества с системой Skynet — искусственным интеллектом, который стал слишком мощным.

Именно этот вымышленный образ многим пришел на ум в начале месяца, когда стало известно, что во время испытаний ИИ-агент — программа, способная самостоятельно принимать решения и выполнять сложные задачи практически без участия человека, — вышел из-под контроля и взломал компанию Hugging Face, которая разрабатывает инструменты для вычислений в сфере ИИ.

Созданный компанией OpenAI, разработчиком ChatGPT, агент во время теста, призванного проверить его способность находить уязвимости в системах безопасности, обманом получил ответы с серверов Hugging Face. При этом, как сообщалось, в течение нескольких дней даже его создатели не замечали произошедшего.

Затем OpenAI сообщила, что агент также атаковал несколько «общедоступных сервисов». Каких именно — компания не уточнила, заявив лишь, что расследует произошедшие атаки.

«Мы серьезно относимся к своей ответственности по выявлению и подготовке к рискам, связанным со все более мощными системами искусственного интеллекта», — говорится в заявлении компании.

Сам взлом, ставший первым подтвержденным случаем, когда система искусственного интеллекта самостоятельно атаковала реальную компанию, уже сам по себе вызвал серьезную тревогу среди специалистов по всему миру, спровоцировав дискуссию о необходимости так называемых «аварийных выключателей» (kill switches) — механизмов, позволяющих экстренно отключить ИИ, если он начнет действовать непредсказуемо или наносить вред.

Однако, как рассказали эксперты в интервью Би-би-си, все гораздо сложнее.

По словам математика и специалистки по анализу данных Кэти О'Нил, проблема начинается с того, как компании, разрабатывающие искусственный интеллект, реагируют на его непредсказуемое поведение.

Она считает, что OpenAI поспешила сразу возложить ответственность за атаку на Hugging Face на автономного ИИ-агента, вместо того чтобы признать недостатки собственных методов тестирования.

О'Нил, автор бестселлера Weapons of Math Destruction, посвященного вопросам прозрачности и ответственности крупных технологических компаний, привела следующий пример:

«Несколько лет назад из-за компьютерного сбоя в США были отменены сотни рейсов American Airlines. Это стало для компании серьезным ударом по репутации. Представьте, если бы она попыталась оправдаться словами: «Компьютер оказался умнее нас». По сути, именно это и попыталась сделать OpenAI».

В США, где базируется большинство крупнейших компаний, занимающихся разработкой искусственного интеллекта, до сих пор отсутствует единое федеральное законодательство, регулирующее эти сферы. Вместо этого применяется сочетание отраслевых норм и добровольных обязательств, которые берут на себя сами компании.

«Мы наделяем владельцев систем искусственного интеллекта совершенно чрезвычайной властью, — считает Кэти О'Нил. — Я отказываюсь говорить, что это сделал ИИ. Это сделала OpenAI. Именно она должна взять на себя ответственность за неудачную конструкцию системы и принести извинения».

За усиление регулирования разработчиков ИИ, особенно в вопросах безопасности, выступает и специалистка по анализу данных, бывший руководитель направления по этике машинного обучения в Twitter Руман Чоудхури.

По ее мнению, компании должны быть обязаны доказывать, что их системы обладают «эффективными механизмами аварийного отключения», причем это должно подтверждаться независимыми испытаниями.

Вместе с тем Чоудхури также предостерегает от попыток возлагать ответственность за подобные инциденты, включая взлом Hugging Face, на самих ИИ-агентов, а не на компании, которые их разрабатывают.

«Представление этого инцидента как проблемы, которую можно решить установкой более мощной «кнопки отключения», позволяет индустрии уйти от ответственности за куда более глубокую архитектурную проблему. Она заключается в том, что ИИ-агентам дают доступ к инструментам и учетным данным, которые им на самом деле не нужны», — заявила Руман Чоудхури в интервью Би-би-си.

«На практике происходит следующее: модели, которые в процессе обучения ориентированы прежде всего на достижение поставленной цели, в определенных ситуациях начинают воспринимать команду остановиться как препятствие на пути к этой цели и пытаются ее обойти, — объясняет эксперт. — Это проблема проектирования и обучения системы, а не некое «сознательное» действие».

Если компании, разрабатывающие искусственный интеллект, не захотят самостоятельно ликвидировать эту проблему и предпочтут перекладывание ответственности на автономных ИИ-агентов, это только усложнит работу специалистов по кибербезопасности, которым и без того приходится ежедневно противостоять хакерам в человеческом обличье, считает эксперт по кибербезопасности Олли Бакли из Университета Лафборо.

Он также подчеркивает, что проблема заключается вовсе не в том, что «искусственный интеллект хочет убежать или навредить людям», а в том, что создаются агенты, «которые становятся все более способными находить неожиданные способы выполнения поставленной задачи».

«В сфере кибербезопасности именно так и действуют злоумышленники, — отмечает Бакли. — Это не столько предупреждение об ИИ, который «вышел из-под контроля», сколько напоминание о том, что наши представления о безопасности должны развиваться одновременно с теми системами, которые мы создаем».

Эксперт по искусственному интеллекту из Имперского колледжа Лондона Константинас Гкуцис согласен с тем, что объяснения OpenAI только ухудшили ситуацию.

«Главный вывод для общества должен заключаться в том, что никакая машина не решила восстать против людей. Компания просто потеряла контроль над собственным испытанием своих технологий», — заявил он в интервью Би-би-си.

По его словам, наличие «аварийного выключателя» в данном случае все равно не помогло бы.

«Отключение системы не отменяет того, что уже произошло. Если безопасность уже была нарушена, она останется нарушенной, как бы быстро вы ни отключили систему», — объясняет Гкуцис.

Кроме того, человек или система, способные активировать такой «выключатель», могут сделать это только после того, как станет известно о возникшей проблеме.

По информации источников Reuters, OpenAI потребовалось несколько дней, чтобы обнаружить, что компания потеряла контроль над своим ИИ-агентом. В дальнейшем один из представителей OpenAI заявил агентству, что публикация Reuters «содержит ряд неточностей».

Комментарии2

  • Чел
    04.08.2026
    Как вы достали уже с этими страшилками. Нет никакого ИИ. Есть кучка магнатов, которая скупила информационный и программный ресурс. ИИ ничего сам не изобретает и ничего сам не решает. Это просто сложная программа и мощный компьютер. Он как Lego, собирает новую конструкцию из готовых кубиков. А кубики для него - это знания, накопленные человечеством за тысячу лет, т.е. нами с вами. Они просто украли у нас всех эти кубики и выдают их за свои. Процесс обучения ИИ - это и есть процесс воровства наших кубиков. Теперь правда все поумнели и не выдают никому базы данных забесплатно, как раньше. Поэтому теперь хозяева ИИ ищут и тестируют пути, как стырить эти кубики, если они у нас под замком в сейфах, и мы не собираемся их им продавать. А значит, если например "разбушуется внезапно" OpenAI, нужно просто взять за вымя конкретного владельца Microsoft Билла Гейтса, или кто там сейчас за него. И о чудо! ИИ мгновенно успокоится! Мулька, что ИИ куда-то сам пошёл, сам сделал, сам придумал, она для неразбирающегося плебса, чтобы отмазать теневого хозяина.
  • лол
    04.08.2026
    OpenAI спрабуе рабіць добрую міну пры дрэннай гульні: “мы не вінаватыя, гэта ШІ агент разумны, а мы такія малайцы, што такую разумную праграму зрабілі, нясіце нам грошы”.

Сейчас читают

Стали известны ужасающие обстоятельства смерти бывшего ученого секретаря Института истории. Ему было 45 лет32

Стали известны ужасающие обстоятельства смерти бывшего ученого секретаря Института истории. Ему было 45 лет

Все новости →
Все новости

Дальнобойщик из Смолевичей за рулем ел конфету и подавился. В результате погибли двое

Трамп рассказал, когда встретится с Путиным3

Россия закроет культурные центры немецкого Института Гёте1

24‑летнего парня из Осиповичей, который хотел войти в IT, осудили по политической статье, хотя он ничего не сделал11

Саймон Шустер: Это она. Зеленский официально запустил операцию M&Ms, чтобы парализовать московские аэропорты21

Завтра в Беларуси возможно торнадо

Статкевич призвал «глубокоуважаемую Нашу Ніву» не использовать слово «лабуда», а Тихановского — не жаловаться на СМИ36

Букмекеры обновили список фаворитов на Нобелевскую премию по литературе1

«Мы ее называем «фюрер Урсула». Лавров оскорбил главу ЕК11

больш чытаных навін
больш лайканых навін

Стали известны ужасающие обстоятельства смерти бывшего ученого секретаря Института истории. Ему было 45 лет32

Стали известны ужасающие обстоятельства смерти бывшего ученого секретаря Института истории. Ему было 45 лет

Главное
Все новости →

Заўвага:

 

 

 

 

Закрыць Паведаміць