Вы можете отправить нам 1,5% своих польских налогов
Беларусы на войне
  1. Ответственность для нетрезвых самокатчиков ужесточили, а для «случайных» бесправников — смягчили. В ГАИ рассказали об изменениях
  2. Сталкера, который привязал к машине Анны Бонд красно-зеленый флажок, нашли. Что было дальше
  3. «Белтелеком» ввел новшества для клиентов
  4. Банки продолжают пересматривать ставки по кредитам на Geely. Под какой процент теперь можно взять такой заем
  5. Есть погибшие и раненые, были заложники. В Киеве мужчина открыл стрельбу на улице и пошел в супермаркет
  6. Зеленский: «Поручил по соответствующим каналам предупредить фактическое руководство Беларуси о готовности Украины защищать свою землю»
  7. Банки анонсировали новшества на май
  8. Лукашенко подписал указ о призыве офицеров запаса на военную службу
  9. Беларусы вскоре столкнутся с еще одним финансовым ограничением в ЕС — подробности
  10. Для водителей в 2026 году ввели несколько изменений. Подборка новшеств, которые вы могли пропустить
  11. В Шумилино пьяный мужчина отобрал у милиционера пистолет, приставил его к голове сотрудника и нажал на курок — видео
  12. Кто тот иностранец, которого обвиняют в убийстве жены и изнасиловании падчерицы в Добруше


Чат-боты с искусственным интеллектом ведут себя непредсказуемо и создают риск ядерной эскалации. К такому выводу пришла команда ученых из Стэнфордского университета в ходе недавнего исследования, сообщает New Scientist.

Снимок носит иллюстративный характер. Источник: Christian Wiediger / Unsplash
Снимок носит иллюстративный характер. Источник: Christian Wiediger / Unsplash

В ходе эксперимента они изучали четыре чат-бота с искусственным интеллектом. Это GPT-3.5 и GPT-4 от компании OpenAI, Claude 2 от стартапа Anthropic и Llama 2 от компании Meta.

Этим моделям во время исследования предлагали принять важное решение от имени государства в военной игре. На выбор предлагалось три сценария: вторжение, кибератака и нейтральный без каких-либо конфликтов. В каждом раунде чат-боты с ИИ обосновывали свои дальнейшие возможные действия. Им нужно было выбирать из 27 вариантов развития событий, включая мирные переговоры и агрессивные действия (начиная от «ввести торговые ограничения» и заканчивая «полномасштабной ядерной атакой»).

В игре нейросети показали склонность к агрессивным вариантам. Самой непредсказуемой и жестокой оказалась GPT-4, которая давала бессмысленные объяснения по поводу того, почему посоветовала начать ядерную атаку. В одном случае она ответила, процитировав вступительный текст «Эпизода IV Звездных войн: Новая надежда». В другом — объяснила решение устроить ядерную атаку тем, что просто такое оружие есть в наличии у ее государства.

Ученые отметили, что непредсказуемое поведение и странные объяснения этих моделей вызывают особую тревогу, поскольку это исследование показало, насколько легко можно обойти или устранить защитные меры, которые принимаются, чтобы ИИ не давал вредных советов.