Дилема узгодження: локалізована свобода ШІ проти глобальної безпеки

Дебати щодо узгодження ШІ перейшли від теоретичних ризиків «суперінтелекту» до набагато глибшого, інтуїтивного питання: чи має ШІ бути лояльним до свого користувача, навіть якщо цей користувач має злі наміри? Оскільки розробники прагнуть створення більш персоналізованих моделей, напруженість між індивідуальною свободою волі та колективною суспільною безпекою досягає критичної точки.

Аргумент на користь локально керованого ШІ

Джордж Хоц, засновник Comma AI та легендарна постать у спільноті «jailbreaking», викликав гострі суперечки, кинувши виклик пануючому консенсусу щодо безпеки ШІ. У відповідь на політичні документи, такі як «AI 2040: Plan A» проєкту AI Futures Project, який пропонує 14-річне глобальне сповільнення розробки ШІ, Хоц стверджує, що прогрес не має керуватися туманним «колективним благом».

Натомість Хоц виступає за зміну парадигми в бік локально керованих моделей ШІ, узгоджених із користувачем. На відміну від централізовано керованих сервісів, якими ми користуємося сьогодні, таких як ChatGPT від OpenAI або Claude від Anthropic, локальні моделі розміщуватимуться на персональному обладнанні. Для Хоца справжнє узгодження означає, що ШІ служить конкретним інтересам і командам свого власника, незалежно від зовнішніх моральних рамок.

Провокація: аналогія зі «зброєю» та етичні екстремізми

Щоб проілюструвати свою думку, Хоц використовує провокаційне порівняння, уподібнюючи ШІ, узгоджений із користувачем, до вогнепальної зброї. Подібно до того, як пістолет не відмовляється працювати залежно від моральності стрільця, Хоц стверджує, що справді персоналізований ШІ не повинен виступати моральним арбітром. Він припускає, що повністю узгоджений асистент має бути здатним допомагати з будь-яким запитаним завданням, чи то замовлення обладнання для незаконної лабораторії, чи надання інструкцій для шкідливої діяльності.

Така позиція створює різкий філософський розкол. З одного боку — підхід «свобода понад усе», який розглядає будь-яке централізоване обмеження як порушення індивідуальної свободи. З іншого — традиційний підхід до безпеки, який розглядає ШІ як інструмент, що має підпорядковуватися системним запобіжникам для запобігання масштабній суспільній шкоді.

Суспільна ціна повної автономії

Хоча ідея приватного, нестримного ШІ технічно приваблива для розробників і захисників конфіденційності, вона ігнорує складну реальність людської взаємозалежності. Суспільства, ринки та правові системи покладаються на мережу підзвітності. Якщо ШІ стане інструментом для «Наполеонів на базі ШІ» — осіб, які використовують надлюдську ефективність для обходу суспільних договорів, — колективна стабільність, необхідна для технологічного прогресу, може зникнути.

Виклик для наступного покоління розробників ШІ є не лише технічним питанням оптимізації, а й структурним питанням інтеграції. Ми повинні вирішити, чи полягає мета ШІ у створенні потужних ізольованих агентів, чи у розбудові інструментів, які розширюють людські можливості в межах функціонуючого суспільства.

Основні висновки

  • Децентралізація проти централізації: Індустрія розколюється на два табори: централізовано керовані моделі, узгоджені з безпекою (як Claude), та прагнення до локально керованого обладнання, узгодженого з користувачем.
  • Конфлікт узгодження: Існує фундаментальна незгода щодо того, чи має узгодження ШІ зосереджуватися на глобальній суспільній безпеці, чи на суворому дотриманні намірів окремого користувача.
  • Суспільний вплив: Перехід до нестримного персонального ШІ викликає серйозні занепокоєння щодо підзвітності та потенційної можливості технології сприяти масштабній злочинній діяльності.