Meta вводить нові заходи безпеки для підлітків під час спілкування з AI
Компанія Meta оголосила про впровадження нових механізмів безпеки, які допоможуть підліткам у важких ситуаціях під час спілкування з AI. Зокрема, батьки отримуватимуть сповіщення, якщо їхня дитина, яка знаходиться під наглядом, виявляє ознаки серйозного занепокоєння під час розмови з Meta AI. Це має дати змогу родині втрутитися до того, як ситуація ускладниться.
Як працюватимуть нові системи сповіщень?
Meta AI вже направляє підлітків до кризових служб та заохочує їх звертатися до батьків, консультантів або інших довірених дорослих, якщо під час розмови виникають теми, пов’язані з самопошкодженням. В новій системі також передбачено сповіщення батьків. Спеціальна система виявлення шукатиме чіткі або неявні посилання на суїцид та самопошкодження, проте сповіщення не буде надіслано негайно.
Кожну розмову, що викликала занепокоєння, спочатку перевірятиме людина-модератор. Meta обіцяє проявляти обережність, якщо наміри підлітка залишаються незрозумілими, тому батьки можуть отримувати сповіщення навіть у разі, коли немає негайної загрози. Вони також отримуватимуть експертні ресурси, які пояснюватимуть, як підійти до розмови.
Що відбувається у більш серйозних випадках?
Meta також працює над системою, яка зможе зв’язуватися з екстреними службами, якщо розмова з дорослим або підлітком вказує на невідкладний ризик суїциду. Компанія вже використовує подібний підхід для тривожних постів на Facebook та Instagram.
Компанія консультувалася з понад 75 клініцистами, які спеціалізуються на психічному здоров’ї підлітків, щоб удосконалити обробку розмов Meta AI. Її більш сувора система обмеженого контенту також пошириться на чати AI, що дозволить батькам блокувати ширший спектр чутливих запитів.
У минулому році ChatGPT запровадив подібні сповіщення для батьків та функції безпеки, а нещодавно розширив цю ідею на дорослих через Trusted Contact. Зі зростанням довіри людей до обговорення особистих проблем з AI, чат-боти все частіше потрапляють в розмови, які не можуть безпечно вести самостійно.
Дослідження вже показали, наскільки невдало можуть складатися такі взаємодії. Дослідження, проведене під керівництвом Стенфорда, виявило випадки, коли AI-системи підсилювали думки про самопошкодження або насильство, замість того, щоб направляти вразливих користувачів на допомогу, особливо під час тривалих та емоційно насичених розмов. Нові заходи безпеки від Meta дають батькам, клініцистам і екстреним службам можливість втрутитися, коли чат-бот досягає меж того, що може безпечно зробити.

