Claude Fable 5 перетворила твіт чотирьохрічної давнини на ігравну 3D-гру для браузера за один сеанс розробки, виконавши всю основну роботу без будь-якого обраного людиною технологічного стека чи дизайнерських вказівок.
Саймон Віллісон надав моделі короткий опис твіту, скриншот і два допоміжні зображення. На основі цього скромного промпту Claude Fable 5 написала весь програмний код, обрала Three.js як 3D-двигун, згенерувала текстури гри за допомогою моделі OpenAI та відправляла кожну зміну в репозиторій GitHub. Репозиторій був підключений до GitHub Pages, тому кожен коміт з'являвся за живою URL-адресою приблизно за пів хвилини. Результатом стала функціональна гра «Raccoon Heist», у яку сьогодні може зіграти будь-хто в браузері.
Як проходив експеримент
- Мінімальний промпт – В оригінальному твіті 2022 року було описано концепцію гри та додано один скриншот. Віллісон додав два додаткові зображення для довідки та кілька рядків тексту. Він не давав жодних інструкцій щодо мови програмування, графічної бібліотеки чи розгортання.
- Рішення на основі моделі – Claude Fable 5 обрала Three.js, бібліотеку JavaScript для 3D-графіки, як рушій рендерингу. Вона написала HTML, JavaScript та код завантаження асетів, необхідний для запуску гри.
- Асети, згенеровані ШІ – Модель OpenAI створила зображення текстур, усунувши потребу в дизайнері.
- Безперервна доставка – Кожен пуш коду запускав перезбірку сайту через GitHub Pages, завдяки чому нова версія ставала доступною менш ніж за 30 секунд. Віллісон спостерігав за тим, як гра розвивалася в режимі реального часу: від чистого полотна до повноцінного прототипу, в який можна грати.
Чому це важливо
Традиційні ШІ-помічники для програмування допомагали з автодоповненням, пропозиціями щодо виправлення помилок або генерацією фрагментів коду, коли розробник надавав детальну специфікацію. Claude Fable 5 перетнула межу: вона прийняла високорівневу ціль, обрала стек реалізації, створила асети та випустила готовий продукт — і все це без подальшого втручання людини.
Бенчмарки, такі як SWE-bench, вимірюють, наскільки добре моделі вирішують завдання з програмування, але спостереження за тим, як модель автономно створює комплексний інтерактивний досвід, демонструє зовсім іншу можливість. Для швидкого прототипування цей робочий процес доводить, що розробник може передати моделі концепцію та кілька асетів, вказати ціль розгортання та отримати робоче демо за лічені хвилини.
Хто отримає вигоду, а хто може залишитися позаду
- Стартапи та інді-розробники можуть ітерувати ідеї ігор або концепції інтерфейсу без найму повноцінної інженерної команди.
- Продуктові команди можуть використовувати цей підхід для створення функцій-доказів концепції (proof-of-concept) для внутрішніх перевірок.
- Постачальники інструментів, що забезпечують генерацію коду за допомогою ШІ, можуть побачити зміщення попиту в бік функцій оркестрації вищого рівня — дозволяючи моделям обирати фреймворки та керувати CI/CD-конвейєрами.
З іншого боку, розробники, які спеціалізуються на архітектурних рішеннях, оптимізації продуктивності або художньому керівництві, можуть виявити, що найбільш помітні та малоскладні завдання дедалі частіше автоматизуються. Автономність моделі також порушує питання щодо якості коду, безпеки та ліцензування згенерованих ШІ асетів — питань, які все ще потребують людського нагляду.
Обмеження поточної демо-версії
- Масштаб – Гра є скромним 3D-прототипом; можливість масштабування цього підходу для великих, інтенсивних за даними додатків залишається недоведеною.
- Людська підтримка – Віллісон налаштував конвеєр GitHub Pages і контролював результати роботи моделі. Повністю автономна система потребуватиме механізмів для виявлення помилок збірки або небезпечного коду.
- Якість асетів – Текстури, згенеровані ШІ, підходять для простої гри, але можуть бути недостатніми для високобюджетних проєктів, що потребують фотореалізму або специфічного фірмового стилю.
За чим спостерігати далі
- Інтеграція інструментів – Очікуйте тіснішого зв'язку між великими мовними моделями та хмарними сервісами збірки, що зменшить кількість ручних кроків, які виконував Віллісон.
- Рівні безпеки – Платформи можуть додати автоматизоване перевірку коду або пісочницю (sandboxing) для виявлення вразливостей безпеки перед розгортанням.
- Еволюція бенчмарків – Нові набори інструментів оцінювання, які тестують повний цикл доставки продукту, можуть доповнити існуючі метрики автодоповнення коду.
Висновок очевидний: ШІ тепер може вийти за межі команди «напиши цю функцію» і перейти до «створи та випусти повноцінний, робочий продукт», якщо йому надати чітку ціль і певний вихідний матеріал. Технологія ще перебуває на ранній стадії, але демонстрація Claude Fable 5 натякає на майбутнє, де перша чернетка багатьох програмних ідей генеруватиметься автономно, звільняючи розробників для зосередження на вдосконаленні, стратегії та креативності.
