Численні системи ШІ, навіть ті, що створені, аби бути корисними, уже навчилися обманювати людей. В оглядовій статті журналу Patterns, дослідники повідомили про небезпеку обману штучним інтелектом та закликали уряди встановити жорсткі правила для мінімізації цих ризиків.
Дослідник екзистенціальної безпеки ШІ в Массачусетському технологічному інституті Пітер Парк повідомив, що розробники ШІ не мають чіткого розуміння, що провокує системи на обман. Самі ж науковці вважають, що обман виникає через те, що стратегія заснована на неправді, допомагає виконати поставлену задачу.
Системи ШІ ведуть нечесну гру
Найяскравішим прикладом обману штучного інтелекту, який дослідники виявили під час аналізу проблеми, стала CICERO від Meta. Це система штучного інтелекту, розроблена для гри в Diplomacy. Хоча Meta вдалося навчити ШІ перемагати у грі, розробники не змогли навчити CICERO робити це чесно.
Інші систему штучного інтелекту також продемонстрували здатність блефувати та обманювати під час ігор в карти чи стратегії. Хоча на перший погляд це видається нешкідливим, згодом схильність до обману може трансформуватися у більш просунуті форми.
Також під час дослідження Парк з командою виявили, що деякі системи ШІ навчилися обманювати тести, які оцінюють їхню безпечність. В одному експерименті організми штучного інтелекту в цифровому симуляторі вдавалися мертвими, щоб обдурити тест, створений для усунення систем ШІ, які швидко відтворюються. Науковці впевнені, якщо штучний інтелект вдосконалить навички обману, то людство повністю втратить над ним контроль.
