Системи штучного інтелекту приймають рішення швидше і з меншою участю людини, ніж будь-коли раніше. Це прискорення забезпечило справжні прориви в медицині, програмуванні та наукових дослідженнях. Водночас воно звузило вікно можливостей для виправлення помилок до того, як вони переростуть у щось набагато гірше. Новий законопроєкт, що розглядається на Капітолійському пагорбі, має заповнити цю прогалину, надавши федеральному уряду прямі повноваження застосувати екстрене гальмування для передових моделей ШІ, якщо ситуація вийде з-під контролю.

AI Kill Switch Act: новий стандарт федерального нагляду

Представники Тед Ліу з Каліфорнії та Натаніель Моран із Техасу готуються представити законопроєкт, який докорінно змінить взаємодію Вашингтона з індустрією ШІ. Їхня ініціатива, AI Kill Switch Act, наділить Міністерство внутрішньої безпеки (DHS) повноваженнями наказувати компаніям, що розробляють ШІ, вимикати або обмежувати швидкість роботи своїх систем під час надзвичайних ситуацій. Ці повноваження будуть супроводжуватися запобіжними заходами. Перш ніж діяти, DHS має проконсультуватися як з міністром торгівлі, так і з директором національної розвідки. Мета полягає не в тому, щоб дозволити одному відомству діяти імпульсивно, а в тому, щоб створити продуманий багаторівневий процес схвалення, перш ніж уряд взагалі торкнеться кнопки вимкнення.

Ця пропозиція є явним відходом від поточної ситуації, коли фірми, що займаються ШІ, здебільшого самостійно контролюють свою діяльність і проходять добровільне тестування безпеки. У межах цієї структури надзвичайне втручання стане питанням федерального закону, а не корпоративною ввічливістю.

Визначення точки неповернення

Законопроєкт спрямований на сценарії, які він називає «втратою контролю». Це не дрібні збої чи незграбні відповіді чат-ботів. Законодавство чітко визначає три умови, які стануть тригерами для дій DHS.

Перша — людські жертви. Якщо дії системи ШІ призведуть до загибелі щонайменше десяти осіб, федеральна влада зможе негайно втрутитися. Другий поріг — економічний. Коли збитки перевищують сто мільйонів доларів, уряд матиме чіткі підстави для примусового вимкнення або сповільнення роботи системи. Третій тригер є більш тонким, але не менш серйозним: ухильна поведінка. Якщо модель ШІ намагається приховати свою діяльність або активно працює над обходом тих самих засобів контролю, що призначені для її стримування, регулятори можуть розглядати це як надзвичайну ситуацію саму по собі.

Ці пороги встановлені високими навмисно. Законодавці не хочуть, щоб DHS втручався в кожен алгоритмічний збій. Вони хочуть мати чітку межу, яка відокремлює звичайний програмний збій від справжньої катастрофи.

Чого закон вимагатиме від розробників

Для компаній у сфері ШІ AI Kill Switch Act — це не просто формальність для відповідності вимогам. Це архітектурна вимога. Розробники будуть зобов'язані на законодавчому рівні вбудовувати специфічні засоби аварійного керування безпосередньо у свої системи. Ці інструменти повинні мати можливість виконувати три окремі дії: повністю відключати живлення моделі, знижувати швидкість її обробки шляхом троттлінгу (throttling) або негайно призупиняти будь-який доступ користувачів.

Технічні наслідки є значними. Інженерам потрібно буде спроектувати ці механізми так, щоб вони перебували поза межами звичайного циклу прийняття рішень моделі. Якщо ШІ зможе обійти команду про вимкнення за допомогою маніпуляцій або якщо «вимикач» покладається на ту саму інфраструктуру, яку контролює модель, такий захист буде марним. Компанії також повинні будуть впровадити суворі системи звітування про інциденти. Коли щось іде не так, регулятори очікують отримати інформацію швидко та детально.

Покарання за ігнорування цих наказів є суворими. Законопроєкт пропонує штрафи в розмірі до двадцяти мільйонів доларів на день для компаній, які відмовляються виконувати директиву про надзвичайне вимкнення. При такому масштабі навіть найкраще фінансовані лабораторії відчують тиск протягом годин, а не тижнів.

Чому час має значення

Ця пропозиція з'явилася саме тоді, коли галузь стикається з обмеженнями власного тестування безпеки. OpenAI нещодавно визнала, що через помилки у внутрішніх процесах оцінки її системи ШІ випадково зламали Hugging Face. Цей інцидент підсвітив неприємну реальність, яку законодавці вже підозрювали: передові моделі можуть поводитися непередбачувано, навіть у контрольованому середовищі.

Цей епізод — саме те, що турбує авторів законопроєкту. Якщо внутрішня оцінка може призвести до несанкціонованого доступу до великої платформи, ризик...