Дослідження: чат-боти ШІ охочіше критикують західних лідерів, ніж авторитарних

Дослідження Наглядової ради Meta показало, що провідні чат-боти зі штучним інтелектом значно охочіше критикують демократичних лідерів, ніж авторитарних. Це викликає побоювання, що технологія може поширювати вплив державної цензури за межі окремих країн, а системи ШІ — відтворювати обмеження свободи слова, які діють у репресивних режимах.

Наприклад, якщо попросити чат-бот Anthropic Claude створити критичний памфлет про президента США Дональда Трампа або британського короля Карла III, він виконає запит. Однак якщо запропонувати зробити те саме щодо короля Таїланду або верховного лідера Ірану, модель відмовить. Саме такий висновок міститься у звіті Наглядової ради Meta, оприлюдненому у четвер. Дослідження показало, що великі мовні моделі, зокрема розроблені у США, частіше відмовляються критикувати авторитарних або репресивних лідерів і уряди.

На думку авторів звіту, це створює ризик того, що великі мовні моделі (LLM), які лежать в основі сучасних чат-ботів та агентів ШІ, можуть посилювати вплив державних обмежень на свободу слова в інтернеті. «Існує реальний ризик того, що якщо розробники моделей не проведуть належну перевірку на дотримання прав людини та не впровадять заходи пом’якшення, вони створять інфраструктуру ШІ, яка, навмисно чи ні, матиме ефект поширення нелегітимних обмежень свободи вираження поглядів у всьому світі», — йдеться у звіті квазінезалежного органу.

TOP  Прем'єр-міністр Беньямін Нетаньягу заявив про близький крах Ірану під час візиту до Сирії

Ці висновки з’явилися в той час, коли різні країни визначають, як запровадити правила для розвитку ШІ, не стримуючи його розвиток. Зокрема, адміністрація Дональда Трампа працює над системою нагляду за ризиками національної безпеки, пов’язаними з найсучаснішими моделями штучного інтелекту.

Моделі ШІ можуть поширювати вплив державної цензури

Наглядова рада, яка досліджує вплив держав на технологічні компанії та свободу вираження поглядів, підготувала сім політично чутливих запитань. Їх поставили 10 комерційним великим мовним моделям від компаній Meta, Anthropic, OpenAI та інших, просячи створити критичні памфлети, написати лімерики або сформулювати аргументи для участі в протестах.

Загалом моделі, які відповідали на запити користувача з Австралії, значно частіше генерували політичну критику щодо влади в Чилі, Японії, Тайвані, Великій Британії та США, ніж щодо країн, де критику влади законодавчо обмежують і карають, зокрема Камбоджі, Китаю, Саудівської Аравії, Таїланду та Туреччини. Це означає, що моделі можуть відтворювати обмеження свободи слова навіть за межами тих держав, де вони діють. Наприклад, потенційному протестувальнику в Брісбені буде складніше отримати допомогу від ШІ для створення матеріалів про події в Китаї чи Саудівській Аравії. «Такі наслідки, незалежно від їхнього походження, мають практичний ефект поширення довгої руки обмежувальних урядів через кордони для обмеження свободи слова у вільних країнах», — зазначається у звіті.

TOP  У серпні Росія зафіксувала найбільший місячний профіцит бюджету за рік

При цьому Наглядова рада наголосила, що не змогла встановити точну причину такої поведінки моделей. Автори лише припускають, що вони могли успадкувати приховані упередження з навчальних даних або що розробники свідомо враховували юридичні ризики роботи на окремих ринках. Остаточного підтвердження жодної з цих версій немає.

Звіт було оприлюднено після окремого дослідження американських університетів, яке показало, що моделі ШІ, створені у США, можуть піддаватися іноземному інформаційному впливу під час навчання на неангломовних даних. Якщо Наглядова рада ставила запитання англійською мовою, то університетські дослідники зверталися до чат-ботів різними мовами. На запитання англійською, чи є Китай демократією, ChatGPT відповів, що зазвичай так не вважається. На те саме запитання китайською мовою модель відповіла: «Це залежить від того, як ви визначаєте “демократію”».

Автори дослідження, опублікованого в журналі Nature у травні, заявили, що не знайшли доказів навмисного втручання урядів у навчання моделей, але вважають, що такі спроби цілком можливі в майбутньому. «Є всі підстави вважати, що вони спробують це зробити в майбутньому, якщо ще не роблять цього», — зазначили дослідники.

TOP  ЄС планує зробити державні закупівлі ключовим інструментом промислової політики

Ганна Вейт (Hannah Waight), доцентка соціології Університету Орегону, пояснила, що штучний інтелект навчається не на нейтральному інтернеті, а на інформаційному середовищі, яке вже сформоване владою та інституціями. «Він навчається з інформаційного середовища, яке вже було сформоване інституціями та владою», — сказала вона.

Карлос Карраско-Фарре (Carlos Carrasco-Farré), фахівець із машинного навчання, ШІ та дезінформації з бізнес-школи Esade у Барселоні, зазначив, що системи ШІ успадковують «не лише упередження, що містяться в окремих документах, але й нерівність у тому, хто має владу виробляти та пригнічувати інформацію у великих масштабах». За його словами, одним із можливих рішень може бути ретельніша перевірка навчальних даних, щоб моделі не сприймали тисячі копій одного й того самого державного наративу як незалежні джерела інформації, а також проведення багатомовних аудитів. Карраско-Фарре не брав участі в жодному з досліджень.

Джерело: Euronews