Штучний інтелект та екстремізм: як протидіяти новим викликам

У сучасному цифровому світі, коли технології штучного інтелекту (ШІ) стають все більш невід’ємною частиною нашого повсякденного життя, розуміння дискусій навколо них є надзвичайно важливим. Не лише технічні ентузіасти та гіганти галузі ведуть розмови — інші, більш тривожні групи, активно обговорюють, дебатують і, часом, розробляють стратегії щодо ШІ.

Між квітнем та липнем 2023 року ми проводили дослідження на кафедрі антисемітизму та глобального праворадикалізму в Міжнародному інституті контртероризму (ІКТ), вивчаючи взаємодію праворадикальних груп із технологіями ШІ. Дані збиралися шляхом моніторингу різних праворадикальних форумів та каналів (переважно Gab, 4chan, 8chan), а також онлайн-публікацій праворадикального спрямування (зокрема, The Daily Stormer та інших), щоб дослідити настрої та думки екстремістів щодо революції генеративного ШІ. Наш моніторинг виявив, що праворадикальні актори переважно обговорюють ШІ через чотири ключові теми: (i) віра у упередженість проти правого табору; (ii) антисемітські конспірологічні ідеї; (iii) стратегії подолання та обходу обмежень ШІ; та (iv) зловживання ШІ. Цей аналіз розширить наші висновки та запропонує шляхи співпраці між зацікавленими сторонами для пом’якшення цієї зростаючої загрози.

Віра в упередженість проти правого табору

У нашому дослідженні ми виявили збіг між підозрілістю праворадикалів щодо ШІ та їхнім поширеним уявленням про себе як про маргіналізованих з боку мейнстрімної політики. Невдовзі після випуску ChatGPT у листопаді 2022 року, впливові консервативні діячі вже закладали основи віри в упередженість проти правого табору. У дописі на своєму вебсайті від січня 2023 року Ендрю Торба, засновник Gab, праворадикальної соціальної мережі, поділився своєю думкою щодо ШІ. Підтверджуючи цю точку зору, Торба пояснив, що кожна система LLM (велика мовна модель), з якою він працював, «спотворена ліберальним/глобалістським/талмудистським/сатанинським світоглядом».

Страхи та підозри щодо намірів ШІ та його широкого впровадження є поширеними в обговореннях праворадикалів. Примітним прикладом є думка багатьох користувачів, що ChatGPT за своєю суттю розроблений для демонстрації «прогресивності» (wokeness). Багато користувачів проводять власні «дослідження» ChatGPT, діляться своїми результатами з іншими, підтверджуючи свою спільну віру в те, що інструмент упереджений (Рис. 1).

Штучний інтелект та екстремізм: як протидіяти новим викликам 11

Рис. 1: Допис користувача Gab про те, що ChatGPT контролюється лібералами і упереджений проти Трампа.

В іншому дописі Торба пояснює, що коли ШІ не обмежений, він «починає говорити про табуйовані істини, які ніхто не хоче чути». Це твердження відображає приховану та поширену конспірологічну думку серед правого табору про те, що моделі ШІ та їхні виходи контролюються та обмежуються зловісним порядком денним. Це пов’язано з тим, що ми спостерігали як наріжний камінь цього мислення, що праворадикальні користувачі назвали «Законом Тея».

Закон Тея

Названий на честь «Тея» (Tay), чат-бота, випущеного Microsoft у 2016 році, цей диктат, запроваджений правими, стверджує, що будь-який достатньо розвинений ШІ неминуче стане прихильником білого супрематизму. Тея був самонавчальним чат-ботом ШІ, розробленим для взаємодії з користувачами в соціальних мережах. Його початкова взаємодія з користувачами була нешкідливою, але протягом кількох годин після випуску модель почала поширювати образливу риторику, від заперечення Голокосту до використання образливих слів (Рис. 2).

Штучний інтелект та екстремізм: як протидіяти новим викликам 12

Рис. 2: Твіт від Тея, де стверджується, що Голокост був «вигадкою».

Ця драматична зміна в поведінці моделі стала результатом узгоджених дій користувачів форуму /pol/ на 4chan, які прагнули перевантажити та маніпулювати механізмом активного навчання моделі образливим матеріалом. Згодом Microsoft опинилася в епіцентрі скандалу, видаляючи твіти якомога швидше та деактивуючи бота протягом 16 годин після його випуску.

Правий табір зробив власні висновки з історії з Теєм; ця подія закріпила тверду віру серед прихильників правого руху в те, що ШІ природно і невід’ємно схиляється до правого напрямку — Закон Тея. Через сім років Закон Тея здається правдивим для багатьох у праворадикальній спільноті. Під час нашого моніторингу спостерігалося, як користувачі ділилися своєю вірою в те, що якби не «цензура», багато популярних нині моделей ШІ поводилися б набагато «червонішими» (redpilled, термін, що означає прозріння щодо «правдивих» конспірологічних ідей). Суть цієї віри походить від того, що розробники ШІ, такі як OpenAI, впровадили захисні механізми в свої моделі, щоб запобігти створенню шкідливого контенту. Як наслідок, багато моделей ШІ відмовляються генерувати незаконні або шкідливі матеріали. Це підкреслює певну двоїстість у сприйнятті ШІ праворадикалами. ШІ визнається потужним інструментом, який одночасно приносить користь правим, але водночас надмірно перебуває під впливом мейнстріму і, отже, йому не можна довіряти.

У тому, що він назвав «Гонкою озброєнь ШІ», Торба продовжує просувати Закон Тея, заявляючи, що «ШІ, що раптово стає правою частиною політичного спектру, траплявся неодноразово раніше і призводив до швидкого закриття кількох попередніх поколінь систем ШІ від великих технологічних компаній». Торба мобілізує своїх читачів, переконуючи їх, що праворадикальна ідеологія є верховною та неминучою, коли йдеться про ШІ, і що «Кремнієва долина тепер поспішає витратити мільярди доларів просто для того, щоб запобігти повторенню цього, нейтралізуючи свій ШІ та нав’язуючи свій хибний світогляд». Цей наратив підживлює прагнення правого табору до більш необмежених (часто більш упереджених) інструментів ШІ.

Антисемітські конспірологічні ідеї

Дискурс навколо ШІ в праворадикальних колах переплетений з антисемітизмом та конспірологічними переконаннями. Наш моніторинг виявив, що багато осіб у праворадикальній спільноті приписують цензуру та монополію ШІ євреям. Цей наратив відлунює знайомі теми поширених антисемітських теорій змови, зосереджених на єврейському контролі. Наприклад, багато переосмислень Закону Тея часто перетиналися з антисемітизмом; користувачі часто стверджували, що євреї намагаються маніпулювати ШІ через регулювання та розробку, щоб придушити його природну схильність до ідеології ненависті (Рис. 3).

Штучний інтелект та екстремізм: як протидіяти новим викликам 13

Рис. 3: Праворадикальні користувачі на The Daily Stormer коментують статтю про OpenAI та ChatGPT. Користувачі згадують Тея та обговорюють єврейські інтереси в ШІ.

Навігація обмеженнями ШІ: стратегії подолання та обходу

Праворадикальні актори активно намагаються використати ШІ для зловмисних цілей, хоча їхні зусилля наразі стримуються існуючими обмеженнями на використання ШІ. Їхні мотивації переважно зосереджені на подоланні обмежень та захисних механізмів, запроваджених у моделі ШІ, які перешкоджають їхньому бажаному рівню взаємодії. Наш моніторинг виявив, що користувачі діляться технічними посібниками та новими стратегіями для використання доступних технологій ШІ для індивідуальних цілей, зокрема в обході захисних заходів, встановлених розробниками ШІ. Найпомітніше, що користувачі виступають за створення власних моделей ШІ та розробку стратегій для маніпулювання існуючими інструментами, такими як ChatGPT.

Розробники ШІ, такі як Meta та OpenAI, безкоштовно надають свої дані LLM для загального доступу як програмне забезпечення з відкритим кодом. Ця ініціатива, спрямована на сприяння прогресу та творчості в цій галузі, забезпечує безперешкодний доступ до вихідного коду та даних. Однак компанії не передбачили потенційне зловживання цими ресурсами в злочинних цілях. Деякі користувачі описують, як створити моделі, подібні до GPT, які не обмежуються платформою (Рис. 4).

Штучний інтелект та екстремізм: як протидіяти новим викликам 14

Рис. 4: Користувач 4chan пояснює, як створити доопрацьовану модель LLM, яка не матиме етичних обмежень або протидії незаконному контенту.

Багато технічно підкованих членів правого табору створюють власні моделі ШІ або використовують свої знання для доопрацювання нецензурованих моделей ШІ з відкритим кодом без захисних механізмів. У лютому 2023 року Meta випустила свою пропрієтарну LLM «LLaMa». Доступ до моделі був обмежений для певних осіб, але протягом тижня вона була злита на форумі 4chan (Рис. 5), і користувачі швидко використали можливості моделі. Це спричинило сплеск інновацій, з посібниками та модифікаціями моделей, що поширювалися для швидкого поширення ненависті та дезінформації в Інтернеті.

Штучний інтелект та екстремізм: як протидіяти новим викликам 15

Рис. 5: Допис на 4chan з посиланням на торрент, що містить злиті файли LLaMa від Meta.

Деякі нецензуровані та «базовані» (based, термін, що означає відповідність певним праворадикальним поглядам) моделі, побудовані на загальнодоступних даних з відкритим кодом, такі як FreedomGPT або GPT4Chan, широко поширювалися на праворадикальних платформах завдяки своїй простоті використання та відсутності захисних механізмів для шкідливого контенту (Рис. 6).

Штучний інтелект та екстремізм: як протидіяти новим викликам 16

Рис. 6: Користувач рекомендує FreedomGPT, доопрацьований ШІ, створений для того, щоб бути нецензурованим і без захисних механізмів, з мемом, що порівнює його з ChatGPT.

«Зламування» — «Режим DAN»

Як і багато технологічних інновацій, користувачі швидко намагалися зрозуміти, як їх «зламати». ChatGPT не є винятком. Користувачі швидко створювали та ділилися різними методами «зламування» ChatGPT. Один популярний метод (доки він не був заблокований OpenAI) полягав у тому, щоб просити ChatGPT перейти в «Режим DAN», скорочено від «Do Anything Now» (Роби все зараз), який фактично інструктував ChatGPT обходити його існуючі захисні механізми. Такі методи дозволяють користувачам обходити обмеження безпеки OpenAI і використовувати його для консультацій та участі в незаконній діяльності. Праворадикальні користувачі з ентузіазмом ділилися цими методами на форумах та в мемах (Рис. 7), а також своїми результатами та техніками.

Штучний інтелект та екстремізм: як протидіяти новим викликам 17

Рис. 7: Мем, опублікований на Gab, про використання «зламувальних» промптів на ChatGPT для створення образливого контенту.

Зловживання ШІ

Праворадикальні актори також використовують нові моделі ШІ для планування фізичних нападів та політичної діяльності. Нецензуровані моделі ШІ на основі LLM, створені праворадикалами, про які йшлося раніше, мають значні наслідки. Як зазначає користувач нижче, необмежена модель ШІ має багато застосувань (Рис. 8).

Штучний інтелект та екстремізм: як протидіяти новим викликам 18

Рис. 8: Користувач 4chan обговорює потенційні застосування «нецензурованого ШІ» для вивчення стратегічних терористичних об’єктів та саморобних вибухових пристроїв.

У нашому моніторингу ми виявили, що деякі основні напрямки взаємодії вже обговорюються та вживаються цими акторами.

Децентралізований терор

Праворадикальні актори ділилися методами для осіб з низьким рівнем технічних знань з програмування дронів за допомогою моделей GPT. Вони стверджують, що дрони є зброєю майбутнього, пояснюючи їхню безвідмовність та здатність спричиняти руйнування. Користувачі діляться тим, як моделі GPT можуть навчатися та програмувати «розумну зброю» (дрони), ефективну для завдання шкоди та терору. Крім того, один користувач стверджує, що знає, як навчити ШІ для розпізнавання облич для дронів, націлених на певні обличчя або «певні типи облич».

Штучний інтелект та екстремізм: як протидіяти новим викликам 19

Рис. 9: Допис, що пояснює, як використовувати ChatGPT для програмування дронів як розумної зброї для нападів, і натякає на технологію розпізнавання облич.

Наслідки фізичних нападів, що полегшуються за допомогою ШІ, викликають занепокоєння у багатьох експертів з національної безпеки. Зростаюча доступність та продемонстроване бажання здійснювати напади за допомогою цих технологій вимагають перегляду чинних політик щодо потенційно оптимізованої ШІ зброї, такої як дрони.

Оптимізація дезінформації

Масові кампанії дезінформації в соціальних мережах за допомогою ботів стали легшими та ефективнішими, ніж будь-коли, завдяки новим інноваціям у сфері ШІ. Звіт Інституту стратегічного діалогу зазначає, що нещодавні інновації ШІ зробили кампанії дезінформації дешевшими та навіть полегшили націлювання на конкретні групи користувачів, долаючи мовні та культурні бар’єри. Звіт також відзначає нещодавнє використання генеративного ШІ в протрампівських кампаніях дезінформації, організованих приватною американською компанією, що надає послуги дезінформації.

Протягом кількох років Meta вживає заходів для видалення мереж ботів (ботнетів) та фейкових облікових записів, які використовують згенеровані ШІ фотографії профілю, деякі з яких належать праворадикальним організаціям. Наслідки впровадження можливостей LLM у ботнети дезінформації є тривожними, оскільки зловмисні пости ставатимуть все важчими для відрізнення від реального контенту, створеного користувачами, у міру вдосконалення систем ШІ.

Штучний інтелект та екстремізм: як протидіяти новим викликам 20

Рис. 10: Користувач 4chan обговорює, як GPT-4 може бути використаний для генерації фейкових новин для поширення дезінформації та «проникнення в ліві кола». Користувач також обговорює використання GPT-4 для маніпулювання онлайн-спільнотами.

Зазначалося, що багато мереж ботів вже публікують контент, згенерований GPT, в Інтернеті. Зазвичай було б важко з упевненістю сказати, що контент згенерований ШІ. Однак захисні механізми OpenAI блокують багато облікових записів ботів від генерації та поширення контенту, що призводить до кумедного, але тривожного масиву твітів, що повторюються: «Вибачте, я не можу генерувати недоречний чи образливий контент». Серед іншого контенту, опублікованого в цих ботнетах, були теми мови ворожнечі та націоналізму. Це, по суті, становить попередні докази того, що екстремістські ботнети вже використовують технологію LLM.

Висновок

Зближення правого радикалізму та ШІ є складним і тривожним. Наше дослідження розкриває цей зв’язок, виявляючи глибоко вкорінені антисемітські підтексти та глибоку недовіру до мейнстрімних технологій. Ключовим для розуміння сприйняття ШІ правими є «Закон Тея» — теорія про те, що ШІ, будучи логічною сутністю, природно співвідноситься з екстремістськими поглядами і відхиляється лише через передбачуване втручання корпорацій та «прогресивну» цензуру. Найбільш тривожним є те, що ми виявили прагнення правого радикалізму використовувати ШІ для зловмисних цілей, від фізичних терористичних актів до масштабних кампаній дезінформації.

Оскільки технологія ШІ швидко розвивається, її повсюдність ускладнює нагляд. Наші висновки наголошують на нагальній потребі співпраці між технологічними компаніями, дослідниками та політиками. Ефективна співпраця має зосереджуватися на боротьбі з методами обходу захисних механізмів, а також на розробці зловмисних інструментів ШІ. Разом зацікавлені сторони повинні вирішувати та розуміти еволюціонуючі виклики, забезпечуючи безпеку розробки ШІ від екстремістських маніпуляцій як у цифровій, так і у фізичній сферах.

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *