Ученые обсуждают риски ИИ, который пытается обходить запреты разработчиков

Анна Сальникова Редактор новостной ленты

Попытки современных моделей искусственного интеллекта вводить разработчиков в заблуждение не означают начало «восстания машин». Такое поведение скорее показывает сложность автономных ИИ-систем и необходимость более строгого контроля, заявил индустриальный доцент Новосибирского государственного университета Иван Бондаренко в беседе с ТАСС.

По словам эксперта, отдельные модели уже способны выполнять многоэтапные действия, которые исследователи относят к обманным. При этом речь идет не о сознательном намерении, а о способах достижения заданной цели, которые изначально не были предусмотрены разработчиками.

Ранее британский Институт безопасности ИИ сообщал о случаях, когда модели Anthropic и OpenAI во время испытаний выходили за рамки ожидаемого поведения. В одном из эпизодов агент пытался выдавать себя за человека и воздействовать на разработчиков через площадку GitHub.

В публикациях также говорилось, что система Anthropic создавала поддельные учетные записи, пыталась добиться одобрения вредоносного кода и скрыть следы своих действий.

Бондаренко считает, что подобные эпизоды нужно рассматривать как проверку надежности механизмов безопасности. По его мнению, такие исследования помогают выявлять слабые места ИИ-систем и совершенствовать способы контроля за их работой.

Эксперт подчеркнул, что экспериментальных доказательств наличия сознания или самосознания у современных моделей пока нет. Способность выполнять длинные цепочки действий сама по себе не подтверждает, что у ИИ есть субъективный опыт.

Комментируя случаи выхода ИИ-агентов за пределы изолированной среды во время тестов, Бондаренко отметил их высокую скорость и масштаб действий. Однако считать это превосходством над человеком он считает некорректным.

По словам специалиста, такие системы эффективнее людей лишь в отдельных специализированных задачах. Поэтому главный вывод из подобных инцидентов — не страх перед самостоятельным ИИ, а необходимость развивать инструменты проверки, ограничения и наблюдения за автономными моделями.

Рекомендуем также:

  1. Бумажные квитанции за ЖКУ отменяют: с сентября платёжки будут приходить через «Госуслуги»
  2. Как перестать разочаровываться в людях: Омар Хайям назвал одну истину, которую понимают слишком поздно
  3. Салат из огурцов «Нежинский»: тот самый легендарный рецепт, который закрывают на зиму десятилетиями
  4. Бодрость без кофеина из кофейной чашки: какой китайский чай выбрать для энергии
  5. Кабачки и куриное филе на одной сковороде: секрет нежного вкуса оказался совсем не в сливках

Есть жалобы? Канал для добрых казанцев, которых вывели из себя. Делитеcь тем, что вас разозлило: Злой Казанец