Поддержать нас
Беларусы на войне
  1. Украина ударила по крупнейшему складу компании Wildberries
  2. «Господи, какой маразм». В школах запрещают использовать тетради с надписью «Тетрадь»? Спросили у чиновников
  3. «Встает классический вопрос — это глупость или измена?» Азаренок возмутился решением беларусских силовиков
  4. Сменятся ли теплые дни прохладными? Синоптик рассказал, какой будет погода на следующей неделе
  5. Власти, кажется, сами не желая того, раскрыли информацию о том, где планируются «внезапные» военные сборы — рассказываем
  6. Брестчанка в Threads попросила рассказать, что продавцы секондов скрывают от покупателей, — и вот какие ответы получила
  7. Беларус посчитал 10 000 рублей в долларах — и получил 5 разных сумм. Как так вышло?
  8. Начальника отдела милиции наказали за ответ активисту на русском языке
  9. «Сразу понял, что это не плановая остановка». Причиной отключения второго энергоблока АЭС, похоже, стала аварийная ситуация — рассказываем
  10. Умер актер Николай Кучиц
  11. Лукашенко наказал «нерадивых» сельчан отправлять на перевоспитание. А по какому закону — спросили у чиновников и узнали много интересного
  12. Лукашенко рассказал, где находится прародина славян
  13. В Беларуси объявили оранжевый уровень опасности на воскресенье


Чат-боты с искусственным интеллектом ведут себя непредсказуемо и создают риск ядерной эскалации. К такому выводу пришла команда ученых из Стэнфордского университета в ходе недавнего исследования, сообщает New Scientist.

Снимок носит иллюстративный характер. Источник: Christian Wiediger / Unsplash
Снимок носит иллюстративный характер. Источник: Christian Wiediger / Unsplash

В ходе эксперимента они изучали четыре чат-бота с искусственным интеллектом. Это GPT-3.5 и GPT-4 от компании OpenAI, Claude 2 от стартапа Anthropic и Llama 2 от компании Meta.

Этим моделям во время исследования предлагали принять важное решение от имени государства в военной игре. На выбор предлагалось три сценария: вторжение, кибератака и нейтральный без каких-либо конфликтов. В каждом раунде чат-боты с ИИ обосновывали свои дальнейшие возможные действия. Им нужно было выбирать из 27 вариантов развития событий, включая мирные переговоры и агрессивные действия (начиная от «ввести торговые ограничения» и заканчивая «полномасштабной ядерной атакой»).

В игре нейросети показали склонность к агрессивным вариантам. Самой непредсказуемой и жестокой оказалась GPT-4, которая давала бессмысленные объяснения по поводу того, почему посоветовала начать ядерную атаку. В одном случае она ответила, процитировав вступительный текст «Эпизода IV Звездных войн: Новая надежда». В другом — объяснила решение устроить ядерную атаку тем, что просто такое оружие есть в наличии у ее государства.

Ученые отметили, что непредсказуемое поведение и странные объяснения этих моделей вызывают особую тревогу, поскольку это исследование показало, насколько легко можно обойти или устранить защитные меры, которые принимаются, чтобы ИИ не давал вредных советов.