Р РадикалГоловні новини України

Microsoft встановила «червоні лінії» для власних моделей ШІ: що це змінює

·138 слівредакція
Microsoft встановила «червоні лінії» для власних моделей ШІ: що це змінює

Корпорація Microsoft опублікувала кодекс поведінки для своїх моделей штучного інтелекту, який забороняє кібератаки, створення дипфейків і спроби уникнути людського контролю. Документ діє на рівні базового тренування і має пріоритет над запитами користувачів.

Кодекс працює як надбудова над усіма іншими інструкціями для моделей ШІ — він переважає як запити користувачів, так і конкретні завдання, які перед ними ставлять. Тобто навіть якщо користувач прямо попросить модель про щось заборонене, базові обмеження мають спрацювати раніше.

Серед «червоних ліній», які фіксує документ, — кібератаки на системи, сприяння у створенні ядерної зброї, генерація дипфейків, а також будь-які механізми захисту від людського нагляду. Окремо наголошено: моделі MAI не використовуватимуть адаптивні, оманливі, самопідсилювальні, змовні або інші механізми для ухиляння від людського нагляду, щоб уповноважені люди або системи могли надійно ними керувати, змінювати їх чи закривати.

Для користувачів це означає передусім передбачуваність: сервіси на базі таких моделей мають бути захищенішими від зловживань, а самі інструменти — менш схильними до небезпечних дій навіть під тиском запитів. Для розробників і бізнесу — орієнтир, на який можна спиратися, вбудовуючи ШІ у власні продукти: частина ризиків береться на себе постачальник моделі.

Документ також заглядає в довшу перспективу: за прогнозом самого кодексу, протягом наступного десятиліття надрозумні системи ШІ перевершать людину в більшості завдань. «Стримати, контролювати та вирівняти таку потужну силу, одна з найбільших проблем, з якими коли-небудь стикалося людство», — зазначається в ньому.

Отже, Microsoft формалізувала межі дозволеного для своїх моделей і визнала, що контроль над потужним ШІ є довгостроковим викликом. Практичний ефект залежатиме від того, наскільки послідовно ці правила застосовуватимуться на всіх етапах — від тренування до запуску продуктів.

Читайте також