Нова архітектура ШІ може дозволити марсоходам і місячним роверам самостійно вирішувати, що вивчати та як пересуватися, не чекаючи на 4–24-хвилинний цикл зв'язку з Землею, що скорочує затримку, яка зараз перешкоджає швидким рішенням. Пропозиція, побудована на моделях decision-transformer, що охоплені рівнем управління з нульовою довірою (zero-trust governance), обіцяє автономію «рівня науковця» для майбутніх планетарних місій.
Чому ровери мають думати самостійно
Сучасні ровери — це, по суті, машини з дистанційним керуванням. Команда з Землі очікує в черзі, поки робот чекає на відповідь, а будь-яка неочікувана перешкода може зупинити місію на години.
Прорив у ШІ: decision transformers
Decision transformers перетворюють вибір дій на завдання моделювання мови. Замість навчання методом спроб і помилок, модель сканує послідовність минулих станів — положення, показники датчиків — та відповідних винагород — наукової цінності, показників безпеки — і передбачає наступну дію, яка б максимізувала винагороду. Фактично, ШІ «пише» найкращий наступний рядок історії, виходячи з того, як ця історія розгорталася до цього моменту.
Забезпечення безпеки ШІ в космосі
У конструкцію закладено два механізми захисту:
Цілі, узгоджені з людиною — команда навчає модель балансувати між трьома критично важливими для місії цілями: максимізацією наукової віддачі (наприклад, вибір найцікавішого каменю), уникненням небезпек (круті схили, втрата енергії) та дотриманням обмежень місії (час, пропускна здатність даних). ШІ не відхиляється від сценарію; кожен вибір зважується відповідно до цих визначених людиною пріоритетів.
Управління з нульовою довірою (zero-trust governance) — запозичена з кібербезпеки, ця структура передбачає, що «мозок» ровера може бути зламаний або просто дати збій. Інженери фіксують кожне рішення в незмінному журналі аудиту та надають ШІ лише мінімальні дозволи, необхідні для дій (принцип найменших привілеїв).
Разом ці рівні дозволяють роверу діяти автономно, зберігаючи при цьому прозорість і можливість скасування ланцюга командування.
Хто отримає вигоду
Майбутні місії, такі як Mars Sample Return або дослідження місячних полюсів, потребують такого рівня автономії. Поєднуючи моделі transformer із суворими протоколами безпеки, ми зможемо глибше дослідити нашу Сонячну систему.
Приховані ризики
Автономія змінює характер ризиків, а рівень нульової довіри пом'якшує це, пропускаючи кожен крок через верифікатор.
Що далі
Цей підхід представлений у дослідженні автора, яке пропонує метод для місій із геологічного дослідження планет.
Висновок: Навчаючи ровери сприймати прийняття рішень як мовну задачу та обгортаючи цю можливість у сувору модель безпеки з пріоритетом аудиту, інженери наближаються до створення роботів, які зможуть займатися наукою на власних умовах, навіть коли Земля недосяжна.
