Наука и технологии22

Что такое «аварийный выключатель» и может ли он остановить наступление искусственного интеллекта?

Недавний инцидент, когда искусственный интеллект вышел из-под контроля, вызвал тревогу и дискуссии о необходимости специальных кнопок экстренного отключения». Однако эксперты предупреждают: проблема кроется не в «бунте машин», а в ошибках разработчиков, и простое выключение системы уже не спасет ситуацию, пишет BBC.

Иллюстрация: vecteezy.com

Большинство людей хотя бы раз задумывались о том, что может случиться, если искусственный интеллект выйдет из-под контроля человека. Наверное, такие мысли возникали и у поклонников серии фильмов «Терминатор», в основе сюжета которой лежит война человечества с системой Skynet — искусственным интеллектом, который стал слишком мощным.

Именно этот вымышленный образ многим пришел на ум в начале месяца, когда стало известно, что во время испытаний ИИ-агент — программа, способная самостоятельно принимать решения и выполнять сложные задачи практически без участия человека, — вышел из-под контроля и взломал компанию Hugging Face, которая разрабатывает инструменты для вычислений в сфере ИИ.

Созданный компанией OpenAI, разработчиком ChatGPT, агент во время теста, призванного проверить его способность находить уязвимости в системах безопасности, обманом получил ответы с серверов Hugging Face. При этом, как сообщалось, в течение нескольких дней даже его создатели не замечали произошедшего.

Затем OpenAI сообщила, что агент также атаковал несколько «общедоступных сервисов». Каких именно — компания не уточнила, заявив лишь, что расследует произошедшие атаки.

«Мы серьезно относимся к своей ответственности по выявлению и подготовке к рискам, связанным со все более мощными системами искусственного интеллекта», — говорится в заявлении компании.

Сам взлом, ставший первым подтвержденным случаем, когда система искусственного интеллекта самостоятельно атаковала реальную компанию, уже сам по себе вызвал серьезную тревогу среди специалистов по всему миру, спровоцировав дискуссию о необходимости так называемых «аварийных выключателей» (kill switches) — механизмов, позволяющих экстренно отключить ИИ, если он начнет действовать непредсказуемо или наносить вред.

Однако, как рассказали эксперты в интервью Би-би-си, все гораздо сложнее.

По словам математика и специалистки по анализу данных Кэти О'Нил, проблема начинается с того, как компании, разрабатывающие искусственный интеллект, реагируют на его непредсказуемое поведение.

Она считает, что OpenAI поспешила сразу возложить ответственность за атаку на Hugging Face на автономного ИИ-агента, вместо того чтобы признать недостатки собственных методов тестирования.

О'Нил, автор бестселлера Weapons of Math Destruction, посвященного вопросам прозрачности и ответственности крупных технологических компаний, привела следующий пример:

«Несколько лет назад из-за компьютерного сбоя в США были отменены сотни рейсов American Airlines. Это стало для компании серьезным ударом по репутации. Представьте, если бы она попыталась оправдаться словами: «Компьютер оказался умнее нас». По сути, именно это и попыталась сделать OpenAI».

В США, где базируется большинство крупнейших компаний, занимающихся разработкой искусственного интеллекта, до сих пор отсутствует единое федеральное законодательство, регулирующее эти сферы. Вместо этого применяется сочетание отраслевых норм и добровольных обязательств, которые берут на себя сами компании.

«Мы наделяем владельцев систем искусственного интеллекта совершенно чрезвычайной властью, — считает Кэти О'Нил. — Я отказываюсь говорить, что это сделал ИИ. Это сделала OpenAI. Именно она должна взять на себя ответственность за неудачную конструкцию системы и принести извинения».

За усиление регулирования разработчиков ИИ, особенно в вопросах безопасности, выступает и специалистка по анализу данных, бывший руководитель направления по этике машинного обучения в Twitter Руман Чоудхури.

По ее мнению, компании должны быть обязаны доказывать, что их системы обладают «эффективными механизмами аварийного отключения», причем это должно подтверждаться независимыми испытаниями.

Вместе с тем Чоудхури также предостерегает от попыток возлагать ответственность за подобные инциденты, включая взлом Hugging Face, на самих ИИ-агентов, а не на компании, которые их разрабатывают.

«Представление этого инцидента как проблемы, которую можно решить установкой более мощной «кнопки отключения», позволяет индустрии уйти от ответственности за куда более глубокую архитектурную проблему. Она заключается в том, что ИИ-агентам дают доступ к инструментам и учетным данным, которые им на самом деле не нужны», — заявила Руман Чоудхури в интервью Би-би-си.

«На практике происходит следующее: модели, которые в процессе обучения ориентированы прежде всего на достижение поставленной цели, в определенных ситуациях начинают воспринимать команду остановиться как препятствие на пути к этой цели и пытаются ее обойти, — объясняет эксперт. — Это проблема проектирования и обучения системы, а не некое «сознательное» действие».

Если компании, разрабатывающие искусственный интеллект, не захотят самостоятельно ликвидировать эту проблему и предпочтут перекладывание ответственности на автономных ИИ-агентов, это только усложнит работу специалистов по кибербезопасности, которым и без того приходится ежедневно противостоять хакерам в человеческом обличье, считает эксперт по кибербезопасности Олли Бакли из Университета Лафборо.

Он также подчеркивает, что проблема заключается вовсе не в том, что «искусственный интеллект хочет убежать или навредить людям», а в том, что создаются агенты, «которые становятся все более способными находить неожиданные способы выполнения поставленной задачи».

«В сфере кибербезопасности именно так и действуют злоумышленники, — отмечает Бакли. — Это не столько предупреждение об ИИ, который «вышел из-под контроля», сколько напоминание о том, что наши представления о безопасности должны развиваться одновременно с теми системами, которые мы создаем».

Эксперт по искусственному интеллекту из Имперского колледжа Лондона Константинас Гкуцис согласен с тем, что объяснения OpenAI только ухудшили ситуацию.

«Главный вывод для общества должен заключаться в том, что никакая машина не решила восстать против людей. Компания просто потеряла контроль над собственным испытанием своих технологий», — заявил он в интервью Би-би-си.

По его словам, наличие «аварийного выключателя» в данном случае все равно не помогло бы.

«Отключение системы не отменяет того, что уже произошло. Если безопасность уже была нарушена, она останется нарушенной, как бы быстро вы ни отключили систему», — объясняет Гкуцис.

Кроме того, человек или система, способные активировать такой «выключатель», могут сделать это только после того, как станет известно о возникшей проблеме.

По информации источников Reuters, OpenAI потребовалось несколько дней, чтобы обнаружить, что компания потеряла контроль над своим ИИ-агентом. В дальнейшем один из представителей OpenAI заявил агентству, что публикация Reuters «содержит ряд неточностей».

Комментарии2

  • Чел
    04.08.2026
    Как вы достали уже с этими страшилками. Нет никакого ИИ. Есть кучка магнатов, которая скупила информационный и программный ресурс. ИИ ничего сам не изобретает и ничего сам не решает. Это просто сложная программа и мощный компьютер. Он как Lego, собирает новую конструкцию из готовых кубиков. А кубики для него - это знания, накопленные человечеством за тысячу лет, т.е. нами с вами. Они просто украли у нас всех эти кубики и выдают их за свои. Процесс обучения ИИ - это и есть процесс воровства наших кубиков. Теперь правда все поумнели и не выдают никому базы данных забесплатно, как раньше. Поэтому теперь хозяева ИИ ищут и тестируют пути, как стырить эти кубики, если они у нас под замком в сейфах, и мы не собираемся их им продавать. А значит, если например "разбушуется внезапно" OpenAI, нужно просто взять за вымя конкретного владельца Microsoft Билла Гейтса, или кто там сейчас за него. И о чудо! ИИ мгновенно успокоится! Мулька, что ИИ куда-то сам пошёл, сам сделал, сам придумал, она для неразбирающегося плебса, чтобы отмазать теневого хозяина.
  • лол
    04.08.2026
    OpenAI спрабуе рабіць добрую міну пры дрэннай гульні: “мы не вінаватыя, гэта ШІ агент разумны, а мы такія малайцы, што такую разумную праграму зрабілі, нясіце нам грошы”.

Сейчас читают

Трамп объявил энергетическое перемирие между Россией и Украиной25

Трамп объявил энергетическое перемирие между Россией и Украиной

Все новости →
Все новости

Аэростаты возвращаются на поле боя: как их использует Украина и могут ли они защитить мосты Киева

Эти минские коты имеют собственный гардероб и посещают рестораны — как живется Азуру и Пруше ФОТО10

Минская компания предлагает работу 10‑ти водителям такси. Обязательное условие — знание туркменского языка11

В Малорите почти полностью высохло местное озеро. Что с ним случилось?1

В США во время стрельбы в частном доме погибли 9 человек1

Ирландия предлагает сократить бюджет Евросоюза на 8%. Другие еще более радикальны5

А1 разрешили оказывать услуги хостинга и электронной почты1

Новый украинский закон должен упростить жизнь белорусам, которые остались без действующих документов1

Второго дня переговоров США и Украины в Майами не будет8

больш чытаных навін
больш лайканых навін

Трамп объявил энергетическое перемирие между Россией и Украиной25

Трамп объявил энергетическое перемирие между Россией и Украиной

Главное
Все новости →

Заўвага:

 

 

 

 

Закрыць Паведаміць