У сучасному цифровому світі, коли технології штучного інтелекту (ШІ) стають все більш невід’ємною частиною нашого повсякденного життя, розуміння дискусій навколо них є надзвичайно важливим. Не лише технічні ентузіасти та гіганти галузі ведуть розмови — інші, більш тривожні групи, активно обговорюють, дебатують і, часом, розробляють стратегії щодо ШІ.
Між квітнем та липнем 2023 року ми проводили дослідження на кафедрі антисемітизму та глобального праворадикалізму в Міжнародному інституті контртероризму (ІКТ), вивчаючи взаємодію праворадикальних груп із технологіями ШІ. Дані збиралися шляхом моніторингу різних праворадикальних форумів та каналів (переважно Gab, 4chan, 8chan), а також онлайн-публікацій праворадикального спрямування (зокрема, The Daily Stormer та інших), щоб дослідити настрої та думки екстремістів щодо революції генеративного ШІ. Наш моніторинг виявив, що праворадикальні актори переважно обговорюють ШІ через чотири ключові теми: (i) віра у упередженість проти правого табору; (ii) антисемітські конспірологічні ідеї; (iii) стратегії подолання та обходу обмежень ШІ; та (iv) зловживання ШІ. Цей аналіз розширить наші висновки та запропонує шляхи співпраці між зацікавленими сторонами для пом’якшення цієї зростаючої загрози.
Віра в упередженість проти правого табору
У нашому дослідженні ми виявили збіг між підозрілістю праворадикалів щодо ШІ та їхнім поширеним уявленням про себе як про маргіналізованих з боку мейнстрімної політики. Невдовзі після випуску ChatGPT у листопаді 2022 року, впливові консервативні діячі вже закладали основи віри в упередженість проти правого табору. У дописі на своєму вебсайті від січня 2023 року Ендрю Торба, засновник Gab, праворадикальної соціальної мережі, поділився своєю думкою щодо ШІ. Підтверджуючи цю точку зору, Торба пояснив, що кожна система LLM (велика мовна модель), з якою він працював, «спотворена ліберальним/глобалістським/талмудистським/сатанинським світоглядом».
Страхи та підозри щодо намірів ШІ та його широкого впровадження є поширеними в обговореннях праворадикалів. Примітним прикладом є думка багатьох користувачів, що ChatGPT за своєю суттю розроблений для демонстрації «прогресивності» (wokeness). Багато користувачів проводять власні «дослідження» ChatGPT, діляться своїми результатами з іншими, підтверджуючи свою спільну віру в те, що інструмент упереджений (Рис. 1).

В іншому дописі Торба пояснює, що коли ШІ не обмежений, він «починає говорити про табуйовані істини, які ніхто не хоче чути». Це твердження відображає приховану та поширену конспірологічну думку серед правого табору про те, що моделі ШІ та їхні виходи контролюються та обмежуються зловісним порядком денним. Це пов’язано з тим, що ми спостерігали як наріжний камінь цього мислення, що праворадикальні користувачі назвали «Законом Тея».
Закон Тея
Названий на честь «Тея» (Tay), чат-бота, випущеного Microsoft у 2016 році, цей диктат, запроваджений правими, стверджує, що будь-який достатньо розвинений ШІ неминуче стане прихильником білого супрематизму. Тея був самонавчальним чат-ботом ШІ, розробленим для взаємодії з користувачами в соціальних мережах. Його початкова взаємодія з користувачами була нешкідливою, але протягом кількох годин після випуску модель почала поширювати образливу риторику, від заперечення Голокосту до використання образливих слів (Рис. 2).

Ця драматична зміна в поведінці моделі стала результатом узгоджених дій користувачів форуму /pol/ на 4chan, які прагнули перевантажити та маніпулювати механізмом активного навчання моделі образливим матеріалом. Згодом Microsoft опинилася в епіцентрі скандалу, видаляючи твіти якомога швидше та деактивуючи бота протягом 16 годин після його випуску.
Правий табір зробив власні висновки з історії з Теєм; ця подія закріпила тверду віру серед прихильників правого руху в те, що ШІ природно і невід’ємно схиляється до правого напрямку — Закон Тея. Через сім років Закон Тея здається правдивим для багатьох у праворадикальній спільноті. Під час нашого моніторингу спостерігалося, як користувачі ділилися своєю вірою в те, що якби не «цензура», багато популярних нині моделей ШІ поводилися б набагато «червонішими» (redpilled, термін, що означає прозріння щодо «правдивих» конспірологічних ідей). Суть цієї віри походить від того, що розробники ШІ, такі як OpenAI, впровадили захисні механізми в свої моделі, щоб запобігти створенню шкідливого контенту. Як наслідок, багато моделей ШІ відмовляються генерувати незаконні або шкідливі матеріали. Це підкреслює певну двоїстість у сприйнятті ШІ праворадикалами. ШІ визнається потужним інструментом, який одночасно приносить користь правим, але водночас надмірно перебуває під впливом мейнстріму і, отже, йому не можна довіряти.
У тому, що він назвав «Гонкою озброєнь ШІ», Торба продовжує просувати Закон Тея, заявляючи, що «ШІ, що раптово стає правою частиною політичного спектру, траплявся неодноразово раніше і призводив до швидкого закриття кількох попередніх поколінь систем ШІ від великих технологічних компаній». Торба мобілізує своїх читачів, переконуючи їх, що праворадикальна ідеологія є верховною та неминучою, коли йдеться про ШІ, і що «Кремнієва долина тепер поспішає витратити мільярди доларів просто для того, щоб запобігти повторенню цього, нейтралізуючи свій ШІ та нав’язуючи свій хибний світогляд». Цей наратив підживлює прагнення правого табору до більш необмежених (часто більш упереджених) інструментів ШІ.
Антисемітські конспірологічні ідеї
Дискурс навколо ШІ в праворадикальних колах переплетений з антисемітизмом та конспірологічними переконаннями. Наш моніторинг виявив, що багато осіб у праворадикальній спільноті приписують цензуру та монополію ШІ євреям. Цей наратив відлунює знайомі теми поширених антисемітських теорій змови, зосереджених на єврейському контролі. Наприклад, багато переосмислень Закону Тея часто перетиналися з антисемітизмом; користувачі часто стверджували, що євреї намагаються маніпулювати ШІ через регулювання та розробку, щоб придушити його природну схильність до ідеології ненависті (Рис. 3).

Навігація обмеженнями ШІ: стратегії подолання та обходу
Праворадикальні актори активно намагаються використати ШІ для зловмисних цілей, хоча їхні зусилля наразі стримуються існуючими обмеженнями на використання ШІ. Їхні мотивації переважно зосереджені на подоланні обмежень та захисних механізмів, запроваджених у моделі ШІ, які перешкоджають їхньому бажаному рівню взаємодії. Наш моніторинг виявив, що користувачі діляться технічними посібниками та новими стратегіями для використання доступних технологій ШІ для індивідуальних цілей, зокрема в обході захисних заходів, встановлених розробниками ШІ. Найпомітніше, що користувачі виступають за створення власних моделей ШІ та розробку стратегій для маніпулювання існуючими інструментами, такими як ChatGPT.
Розробники ШІ, такі як Meta та OpenAI, безкоштовно надають свої дані LLM для загального доступу як програмне забезпечення з відкритим кодом. Ця ініціатива, спрямована на сприяння прогресу та творчості в цій галузі, забезпечує безперешкодний доступ до вихідного коду та даних. Однак компанії не передбачили потенційне зловживання цими ресурсами в злочинних цілях. Деякі користувачі описують, як створити моделі, подібні до GPT, які не обмежуються платформою (Рис. 4).

Багато технічно підкованих членів правого табору створюють власні моделі ШІ або використовують свої знання для доопрацювання нецензурованих моделей ШІ з відкритим кодом без захисних механізмів. У лютому 2023 року Meta випустила свою пропрієтарну LLM «LLaMa». Доступ до моделі був обмежений для певних осіб, але протягом тижня вона була злита на форумі 4chan (Рис. 5), і користувачі швидко використали можливості моделі. Це спричинило сплеск інновацій, з посібниками та модифікаціями моделей, що поширювалися для швидкого поширення ненависті та дезінформації в Інтернеті.

Деякі нецензуровані та «базовані» (based, термін, що означає відповідність певним праворадикальним поглядам) моделі, побудовані на загальнодоступних даних з відкритим кодом, такі як FreedomGPT або GPT4Chan, широко поширювалися на праворадикальних платформах завдяки своїй простоті використання та відсутності захисних механізмів для шкідливого контенту (Рис. 6).

«Зламування» — «Режим DAN»
Як і багато технологічних інновацій, користувачі швидко намагалися зрозуміти, як їх «зламати». ChatGPT не є винятком. Користувачі швидко створювали та ділилися різними методами «зламування» ChatGPT. Один популярний метод (доки він не був заблокований OpenAI) полягав у тому, щоб просити ChatGPT перейти в «Режим DAN», скорочено від «Do Anything Now» (Роби все зараз), який фактично інструктував ChatGPT обходити його існуючі захисні механізми. Такі методи дозволяють користувачам обходити обмеження безпеки OpenAI і використовувати його для консультацій та участі в незаконній діяльності. Праворадикальні користувачі з ентузіазмом ділилися цими методами на форумах та в мемах (Рис. 7), а також своїми результатами та техніками.

Зловживання ШІ
Праворадикальні актори також використовують нові моделі ШІ для планування фізичних нападів та політичної діяльності. Нецензуровані моделі ШІ на основі LLM, створені праворадикалами, про які йшлося раніше, мають значні наслідки. Як зазначає користувач нижче, необмежена модель ШІ має багато застосувань (Рис. 8).

У нашому моніторингу ми виявили, що деякі основні напрямки взаємодії вже обговорюються та вживаються цими акторами.
Децентралізований терор
Праворадикальні актори ділилися методами для осіб з низьким рівнем технічних знань з програмування дронів за допомогою моделей GPT. Вони стверджують, що дрони є зброєю майбутнього, пояснюючи їхню безвідмовність та здатність спричиняти руйнування. Користувачі діляться тим, як моделі GPT можуть навчатися та програмувати «розумну зброю» (дрони), ефективну для завдання шкоди та терору. Крім того, один користувач стверджує, що знає, як навчити ШІ для розпізнавання облич для дронів, націлених на певні обличчя або «певні типи облич».

Наслідки фізичних нападів, що полегшуються за допомогою ШІ, викликають занепокоєння у багатьох експертів з національної безпеки. Зростаюча доступність та продемонстроване бажання здійснювати напади за допомогою цих технологій вимагають перегляду чинних політик щодо потенційно оптимізованої ШІ зброї, такої як дрони.
Оптимізація дезінформації
Масові кампанії дезінформації в соціальних мережах за допомогою ботів стали легшими та ефективнішими, ніж будь-коли, завдяки новим інноваціям у сфері ШІ. Звіт Інституту стратегічного діалогу зазначає, що нещодавні інновації ШІ зробили кампанії дезінформації дешевшими та навіть полегшили націлювання на конкретні групи користувачів, долаючи мовні та культурні бар’єри. Звіт також відзначає нещодавнє використання генеративного ШІ в протрампівських кампаніях дезінформації, організованих приватною американською компанією, що надає послуги дезінформації.
Протягом кількох років Meta вживає заходів для видалення мереж ботів (ботнетів) та фейкових облікових записів, які використовують згенеровані ШІ фотографії профілю, деякі з яких належать праворадикальним організаціям. Наслідки впровадження можливостей LLM у ботнети дезінформації є тривожними, оскільки зловмисні пости ставатимуть все важчими для відрізнення від реального контенту, створеного користувачами, у міру вдосконалення систем ШІ.

Зазначалося, що багато мереж ботів вже публікують контент, згенерований GPT, в Інтернеті. Зазвичай було б важко з упевненістю сказати, що контент згенерований ШІ. Однак захисні механізми OpenAI блокують багато облікових записів ботів від генерації та поширення контенту, що призводить до кумедного, але тривожного масиву твітів, що повторюються: «Вибачте, я не можу генерувати недоречний чи образливий контент». Серед іншого контенту, опублікованого в цих ботнетах, були теми мови ворожнечі та націоналізму. Це, по суті, становить попередні докази того, що екстремістські ботнети вже використовують технологію LLM.
Висновок
Зближення правого радикалізму та ШІ є складним і тривожним. Наше дослідження розкриває цей зв’язок, виявляючи глибоко вкорінені антисемітські підтексти та глибоку недовіру до мейнстрімних технологій. Ключовим для розуміння сприйняття ШІ правими є «Закон Тея» — теорія про те, що ШІ, будучи логічною сутністю, природно співвідноситься з екстремістськими поглядами і відхиляється лише через передбачуване втручання корпорацій та «прогресивну» цензуру. Найбільш тривожним є те, що ми виявили прагнення правого радикалізму використовувати ШІ для зловмисних цілей, від фізичних терористичних актів до масштабних кампаній дезінформації.
Оскільки технологія ШІ швидко розвивається, її повсюдність ускладнює нагляд. Наші висновки наголошують на нагальній потребі співпраці між технологічними компаніями, дослідниками та політиками. Ефективна співпраця має зосереджуватися на боротьбі з методами обходу захисних механізмів, а також на розробці зловмисних інструментів ШІ. Разом зацікавлені сторони повинні вирішувати та розуміти еволюціонуючі виклики, забезпечуючи безпеку розробки ШІ від екстремістських маніпуляцій як у цифровій, так і у фізичній сферах.
