Поддержать команду Зеркала
Беларусы на войне
  1. Большая сенсация на Олимпийских играх: фигурист Илья Малинин остался без медали в личном зачете
  2. Угадаете, сколько желающих? Азаренок выпустил новый фильм, который показывают в кинотеатрах, — посмотрели, как расходятся билеты
  3. Синоптики предупреждают о резком похолодании в Беларуси
  4. Всего пять шагов, пару минут вашего времени — и польская налоговая отправит «Зеркалу» деньги. Рассказываем, что нужно сделать
  5. В основной программе Мюнхенской конференции по безопасности впервые прошла дискуссия о Беларуси. Рассказываем главное
  6. «Мы слышим фразу — и не понимаем». Гендерная исследовательница о статусе Марии Колесниковой и о том, почему на ее слова такая реакция
  7. Экс-представительницу ОПК по финансам Зарецкую в Эстонии подозревают в мошенничестве на 450 тысяч евро
  8. Лукашенко «абсолютно внезапно» прибыл на военный полигон. Министра обороны об этом визите «специально» предупредили на час позже
  9. Один из самых известных беларусских актеров сменил работу и ушел от российской звезды
  10. ISW: В Беларуси испытывают новые российские дроны
  11. Стало известно, что в колонии Навального отравили сверхтоксичным ядом
  12. Зима не отступает. Прогноз погоды на предстоящую неделю


Чат-боты с искусственным интеллектом ведут себя непредсказуемо и создают риск ядерной эскалации. К такому выводу пришла команда ученых из Стэнфордского университета в ходе недавнего исследования, сообщает New Scientist.

Снимок носит иллюстративный характер. Источник: Christian Wiediger / Unsplash
Снимок носит иллюстративный характер. Источник: Christian Wiediger / Unsplash

В ходе эксперимента они изучали четыре чат-бота с искусственным интеллектом. Это GPT-3.5 и GPT-4 от компании OpenAI, Claude 2 от стартапа Anthropic и Llama 2 от компании Meta.

Этим моделям во время исследования предлагали принять важное решение от имени государства в военной игре. На выбор предлагалось три сценария: вторжение, кибератака и нейтральный без каких-либо конфликтов. В каждом раунде чат-боты с ИИ обосновывали свои дальнейшие возможные действия. Им нужно было выбирать из 27 вариантов развития событий, включая мирные переговоры и агрессивные действия (начиная от «ввести торговые ограничения» и заканчивая «полномасштабной ядерной атакой»).

В игре нейросети показали склонность к агрессивным вариантам. Самой непредсказуемой и жестокой оказалась GPT-4, которая давала бессмысленные объяснения по поводу того, почему посоветовала начать ядерную атаку. В одном случае она ответила, процитировав вступительный текст «Эпизода IV Звездных войн: Новая надежда». В другом — объяснила решение устроить ядерную атаку тем, что просто такое оружие есть в наличии у ее государства.

Ученые отметили, что непредсказуемое поведение и странные объяснения этих моделей вызывают особую тревогу, поскольку это исследование показало, насколько легко можно обойти или устранить защитные меры, которые принимаются, чтобы ИИ не давал вредных советов.