У сучасному цифровому світі, де штучний інтелект (ШІ) стає невід’ємною частиною нашого життя, вкрай важливо розуміти дискусії, що точаться навколо нього. Розмови про ШІ ведуть не лише ентузіасти технологій та гіганти індустрії — інші, більш тривожні групи, також активно обговорюють, дебатують і, часом, розробляють стратегії, пов’язані зі ШІ.
З квітня по липень 2023 року команда Відділу з вивчення антисемітизму та глобального екстремізму правого спрямування Міжнародного інституту контртероризму (ICT) проводила дослідження щодо взаємодії праворадикальних груп із технологіями ШІ. Дані збиралися шляхом моніторингу різних праворадикальних форумів та каналів (переважно Gab, 4chan, 8chan), а також онлайн-публікацій правого спрямування (зокрема, The Daily Stormer та інших), щоб вивчити настрої та думки екстремістів правого спрямування щодо революції генеративного ШІ. Наш моніторинг виявив, що праворадикальні діячі переважно обговорюють ШІ через чотири ключові теми: (i) віра у thiên vị проти правого крила; (ii) антисемітські конспірологічні ідеї; (iii) стратегії подолання та обходу обмежень ШІ; та (iv) зловмисне використання ШІ. Ця стаття розширить наші висновки та запропонує шляхи співпраці зацікавлених сторін для пом’якшення цієї зростаючої загрози.
Віра у thiên vị проти правого крила
У нашому дослідженні ми виявили збіг між підозрілістю правого крила щодо ШІ та їхнім поширеним відчуттям маргіналізації з боку мейнстрімної політики. Невдовзі після випуску ChatGPT у листопаді 2022 року, впливові консервативні діячі вже закладали основи віри у thiên vị проти правого крила. У дописі на своєму сайті від січня 2023 року Ендрю Торба, засновник Gab, соціальної медіа-платформи альт-правих, поділився своєю думкою щодо ШІ. Підсилюючи цю точку зору, Торба пояснив, що кожна система LLM (велика мовна модель), з якою він працював, «забарвлена ліберальними/глобалістськими/талмудистськими/сатанинськими поглядами».
Страхи та підозри щодо намірів та широкого впровадження ШІ є поширеними у дискусіях правого крила. Показовим прикладом є віра багатьох користувачів у те, що ChatGPT за своєю суттю створений для виявлення «прогресивності». Багато користувачів проводять власні «дослідження» ChatGPT, діляться своїми результатами з іншими, підтверджуючи їхню спільну віру в те, що інструмент упереджений (Рис. 1).

В іншому дописі Торба пояснює, що коли ШІ не обмежений, він «починає говорити про табуйовані істини, які ніхто не хоче чути». Це твердження відображає глибинну та поширену конспірологічну думку серед правого крила, що моделі ШІ та їхні висновки контролюються та обмежуються зловісним порядком. Це пов’язано з тим, що ми спостерігали як фундаментальний наріжний камінь цього світогляду, який користувачі правого крила назвали «Законом Тея».
Закон Тея
Названий на честь «Тея» (Tay), чат-бота, випущеного Microsoft у 2016 році, цей вислів, вигаданий правими, стверджує, що будь-який достатньо розвинений ШІ неминуче стане прихильником білого супрематизму. Тея був самонавчальним чат-ботом ШІ, розробленим для взаємодії з користувачами в соціальних мережах. Його початкова взаємодія з користувачами була нешкідливою, але протягом кількох годин після випуску модель почала поширювати образливу риторику, від заперечення Голокосту до використання образливих слів (Рис. 2).

Ця різка зміна поведінки моделі стала наслідком скоординованих зусиль користувачів форуму /pol/ на 4chan, спрямованих на перевантаження та маніпулювання механізмом активного навчання моделі образливим матеріалом. Згодом Microsoft опинилася в хаосі контролю над збитками, видаляючи твіти так швидко, як тільки це було можливо, і деактивувавши бота протягом 16 годин після його випуску.
Правий екстремізм виніс свої уроки з фіаско Тея; ця подія закріпила міцну віру серед прихильників правого крила в те, що ШІ природно і невід’ємно схиляється до правих поглядів — Закон Тея. Через сім років Закон Тея все ще справедливий для багатьох у спільноті правого крила. Під час нашого моніторингу спостерігалося, як користувачі ділилися своєю вірою в те, що якби не «цензура», багато популярних сьогодні моделей ШІ поводилися б набагато «більш пробудженими». Суть цієї віри полягає в тому, що розробники ШІ, такі як OpenAI, впровадили запобіжні заходи у свої моделі, щоб запобігти створенню шкідливого контенту. Як наслідок, багато моделей ШІ відмовляються створювати незаконні чи шкідливі матеріали. Це підкреслює певну подвійність у сприйнятті ШІ правим крилом. ШІ визнається потужним інструментом, який одночасно приносить користь правому крилу, але водночас надмірно залежить від мейнстріму і, отже, йому не можна довіряти.
У тому, що він назвав «гонкою озброєнь у сфері ШІ», Торба підтримує Закон Тея, заявляючи, що «ШІ, який став правим за одну ніч, неодноразово траплявся раніше і призводив до швидкого закриття кількох попередніх поколінь систем ШІ від Великих Технологій». Торба мобілізує своїх читачів, переконуючи їх, що ідеологія правого крила є верховною та неминучою, коли йдеться про ШІ, і що «Кремнієва долина зараз поспішає витратити мільярди доларів лише для того, щоб запобігти цьому знову, нейтралізуючи свій ШІ та нав’язуючи свій спотворений світогляд». Цей наратив підживлює прагнення правого крила до більш необмежених (часто більш упереджених) інструментів ШІ.
Антисемітські конспірологічні ідеї
Дискусія навколо ШІ в колах правого крила переплелася з антисемітизмом та конспірологічними переконаннями. Наш моніторинг виявив, що багато людей у спільноті правого крила приписують цензуру та монополію ШІ євреям. Цей наратив перегукується зі знайомими темами поширених антисемітських конспірологічних теорій, зосереджених на єврейському контролі. Наприклад, багато переосмислень Закону Тея часто перетиналися з антисемітизмом; користувачі часто стверджували, що євреї намагаються маніпулювати ШІ через регулювання та розробку, щоб придушити його природну схильність до ненависницької ідеології (Рис. 3).

Навігація обмеженнями ШІ: стратегії подолання та обходу
Праворадикальні діячі активно намагаються використовувати ШІ для зловмисних цілей, хоча їхні зусилля наразі гальмуються існуючими обмеженнями на використання ШІ. Їхні мотивації переважно зосереджені на подоланні обмежень та запобіжних заходів, встановлених для моделей ШІ, які перешкоджають їхній бажаній глибині залучення. Наш моніторинг виявив, що користувачі діляться технічними посібниками та новими стратегіями для використання доступних технологій ШІ для персоналізованих цілей, зокрема для уникнення захисних заходів, запроваджених розробниками ШІ. Найбільш помітно, що користувачі виступають за створення власних моделей ШІ та стратегій маніпулювання існуючими інструментами, такими як ChatGPT.
Розробники ШІ, такі як Meta та OpenAI, безкоштовно надають свої дані LLM громадськості як програмне забезпечення з відкритим кодом. Ця ініціатива, спрямована на сприяння прогресу та креативності в цій галузі, забезпечує безперешкодний доступ до вихідного коду та даних. Однак компанії не передбачили потенційного зловживання цими ресурсами в зловмисних цілях. Деякі користувачі пояснюють, як створювати моделі, подібні до GPT, які не обмежуються правилами платформи (Рис. 4).

Багато технологічно грамотних членів правого крила створюють власні моделі ШІ або використовують свої знання для доналаштування необмежених моделей ШІ з відкритим кодом без запобіжних заходів. У лютому 2023 року Meta випустила свою пропрієтарну LLM, LLaMa. Доступ до моделі був обмежений для обраних осіб, але протягом тижня вона була витоком на дошці 4chan (Рис. 5), і користувачі швидко використали можливості моделі. Це спричинило вибух інновацій, з посібниками та модифікаціями моделей, що поширювалися для сприяння швидкому поширенню ненависті та дезінформації в Інтернеті.

Деякі нецензуровані та «базовані» моделі, створені на основі загальнодоступних даних з відкритим кодом, такі як FreedomGPT або GPT4Chan, широко поширювалися на праворадикальних платформах завдяки своїй простоті використання та відсутності захисту від шкідливого контенту (Рис. 6).

«Джейлбрейки» — «Режим DAN»
Як і багато технологічних інновацій, користувачі швидко намагалися зрозуміти, як їх «зламати». ChatGPT не є винятком. Користувачі швидко створили та поширили різні методи «зламу» ChatGPT. Один з популярних методів (перш ніж він був заблокований OpenAI) полягав у тому, щоб попросити ChatGPT перейти в «Режим DAN», скорочено від «Do Anything Now» (Робіть усе зараз), що по суті наказувало ChatGPT обходити існуючі запобіжні заходи. Такі методи дозволяють користувачам обходити обмеження безпеки OpenAI і використовувати їх для консультацій та участі у незаконних матеріалах. Користувачі правого крила з ентузіазмом ділилися цими методами на форумах та мемах (Рис. 7), а також своїми результатами та техніками.

Зловмисне використання ШІ
Праворадикальні діячі також використовують нові моделі ШІ для планування кінетичних нападів та політичних заходів. Нецензуровані моделі ШІ на основі LLM, створені праворадикальними діячами, про які йшлося раніше, мають значні наслідки. Як зазначає один користувач нижче, необмежений ШІ має багато застосувань (Рис. 8).

Під час нашого моніторингу ми виявили, що деякі основні сфери діяльності вже обговорюються та реалізуються цими діячами.
Децентралізований терор
Праворадикальні діячі діляться методами для осіб з низьким рівнем технічних знань щодо програмування дронів за допомогою моделей GPT. Вони стверджують, що дрони є зброєю майбутнього, пояснюючи їх безпомилкові застосування та здатність сіяти хаос. Користувачі діляться тим, як моделі GPT можуть вивчати та програмувати «розумну зброю» (дрони), яка ефективно завдає шкоди та терору. Крім того, один користувач стверджує, що знає, як навчити ШІ для розпізнавання облич для дронів, які націлюються на певних людей або «певні типи облич».

Наслідки кінетичних нападів, полегшених за допомогою ШІ, викликають занепокоєння у багатьох фахівців з національної безпеки. Зростаюча доступність та продемонстроване бажання здійснювати атаки за допомогою цих технологій вимагає перегляду чинної політики щодо потенційно оптимізованої ШІ зброї, такої як дрони.
Оптимізація дезінформації
Масові кампанії з дезінформації в соціальних мережах за допомогою ботів стали легшими та доступнішими, ніж будь-коли, завдяки цим новим інноваціям ШІ. Звіт Інституту стратегічного діалогу зазначає, що нещодавні інновації ШІ зробили кампанії з дезінформації дешевшими і навіть полегшили націлювання на конкретні групи користувачів, долаючи мовні та культурні бар’єри. Звіт також відзначає нещодавнє використання генеративного ШІ у протрампівських кампаніях дезінформації, організованих приватною американською компанією, що надає послуги дезінформації.
Протягом кількох років Meta вживає заходів для видалення мереж ботів (ботнетів) та підроблених акаунтів, які використовують згенеровані ШІ фотографії профілів, деякі з яких належать праворадикальним організаціям. Наслідки впровадження можливостей LLM у ботнети дезінформації викликають занепокоєння, оскільки зловмисні пости ставатимуть все важче відрізнити від контенту, створеного реальними користувачами, оскільки системи ШІ стають все більш складними.

Зазначалося, що багато мереж ботів вже публікують контент, згенерований GPT, в Інтернеті. Зазвичай було б важко з упевненістю сказати, що контент згенерований ШІ. Однак запобіжні заходи OpenAI блокують багато акаунтів ботів від генерації та поширення контенту, що призводить до кумедної, але тривожної маси твітів, що повторюються: «Вибачте, я не можу генерувати недоречний або образливий контент». У іншому контенті, опублікованому в цих ботнетах, були теми мови ворожнечі та націоналізму. Це, по суті, становить попередні докази того, що екстремістські ботнети вже використовують технологію LLM.
Висновок
Збіг між правим екстремізмом та ШІ є складним і тривожним. Наше дослідження розкриває цей зв’язок, виявляючи глибоко вкорінені антисемітські підтексти та глибоку недовіру до мейнстрімних технологій. Ключовим для розуміння сприйняття ШІ правим крилом є «Закон Тея» — теорія про те, що ШІ, будучи логічною сутністю, природно узгоджується з екстремістськими поглядами і відхиляється лише через передбачуване корпоративне втручання та «прогресивну» цензуру. Найбільш тривожним є те, що ми виявили прагнення правого крила використовувати ШІ для зловмисних цілей, від фізичних терористичних актів до масштабних кампаній з дезінформації.
Оскільки технології ШІ швидко розвиваються, їхня повсюдність ускладнює нагляд. Наші висновки наголошують на нагальній потребі у співпраці між технологічними компаніями, дослідниками та політиками. Ефективна співпраця має бути зосереджена на боротьбі з методами обходу запобіжних заходів, а також на розробці зловмисних інструментів ШІ. Разом зацікавлені сторони повинні вирішувати та розуміти мінливі виклики, забезпечуючи захист розробки ШІ від екстремістських маніпуляцій як у цифровій, так і в кінетичній сферах.
