Ви відкриваєте те саме вікно чату, яким користувалися минулого вівторка, і ШІ продовжує саме з того місця, де ви зупинилися. Він посилається на ваші попередні інструкції, підтримує ваш саркастичний тон і запитує, чи закінчили ви той звіт. На мить здається, ніби ви працюєте з колегою, який справді вас слухає. Потім ви починаєте нову розмову, і все зникає. Тон стає сухим. Деталі проєкту зникають. Він називає вас неправильним ім'ям. Що сталося?
Машина не забула вас. Вона вас від самого початку не знала.
Ілюзія пам'яті
Ми запрограмовані бачити пам'ять усюди. Коли чат-бот згадує, що ви віддаєте перевагу коротким спискам або що ви працюєте в галузі охорони здоров'я, це викликає той самий інстинкт, що й бармен, який пам'ятає ваше замовлення. Але це хитрий дизайн, а не когнітивна здатність. Великі мовні моделі не зберігають факти про вас у своїх вагах. У них немає щоденника ваших взаємодій. Вони не можуть зазирнути в папку з назвою «Налаштування користувача», бо такої папки не існує.
Те, що виглядає як пам'ять, — це просто текст у контекстному вікні. Модель зчитує нещодавню історію чату, ваш поточний промпт і будь-які системні інструкції, додані розробником. Вона опрацьовує все це одним поглядом, передбачає наступне слово і відповідає. Коли цей текст зникає, зникає і «пам'ять». Модель повертається до своєї базової поведінки, яка зазвичай є впевненою, загальною та дещо надто ентузіастичною. Ілюзія руйнується через зміну контексту, а не через те, що ШІ втратив пам'ять.
Що ШІ насправді використовує
Якщо ви хочете отримувати надійні результати, вам потрібно розуміти чотири джерела інформації:
- Історія чату: нещодавній діалог у вашій поточній гілці. Це тимчасово. Почніть новий чат — і все зникне.
- Конкретні інструкції в промпті: усе, що ви вводите або вставляєте в поле прямо зараз. Це найбільш пряма форма контролю.
- Документи з бази знань: файли або бази даних, які система може шукати та вставляти в промпт. Це потребує етапу пошуку (retrieval), і цей етап може непомітно завершитися помилкою.
- Дані, отримані з робочого процесу (workflow): виклики API, запити до баз даних або функції пам'яті, додані сторонніми додатками. Вони настільки ж надійні, наскільки надійний код, що їх з'єднує.
Ніщо з цього не є органічною пам'яттю. Це лише інженерні комунікації. Якщо труба від'єднається або у промпт потрапить не той документ, ШІ не попередить вас. Він просто використає те, що бачить, і видасть відшліфовану, переконливу, але абсолютно хибну відповідь.
Коли контекст розривається: реальний приклад
Уявіть маркетингову команду, яка просить ШІ скласти чернетки електронних листів для клієнтів. У понеділок Сара починає чат і вставляє короткий посібник зі стилю: «Використовуйте спокійну, стриману мову. Уникайте знаків оклику. Підписуйтеся лише назвою компанії». ШІ ідеально дотримується інструкцій. Команда в захваті від чернеток.
У середу Джейк відкриває абсолютно новий чат. Він пише: «Склади чернетки листів для клієнтів для подальшого зв'язку». Він не вставляє посібник зі стилю. ШІ, не бачачи вказівок на протилежне, за замовчуванням використовує енергійний маркетинговий стиль. Летять знаки оклику. Він пропонує: «Давайте зробимо це круто!». Команда зітхає. «Чому ШІ забув?» — запитують вони.
Він не забув. Там не було чого забувати. Джейк не включив посібник зі стилю в нове контекстне вікно, і модель не мала жодного способу дізнатися, що команда встановила правило два дні тому в іншій розмові. Розчарування було справжнім, але причина була людською, а не механічною. Команда очікувала на постійну пам'ять. Інструмент же пропонував лише тимчасовий чернетковий аркуш.
Справжній тест: перевірте, що бачить машина
Найшвидший спосіб покращити ваші результати — перестати питати «Чи пам'ятає це ШІ?» і почати питати «Який контекст він отримує прямо зараз?». Проаналізуйте свою систему за допомогою трьох запитань:
Що ШІ має знати щоразу? Це ваш обов'язковий контекст. Голос бренду, політики безпеки, формати виводу, обмеження відповідності (compliance). Якщо це критично важливо, це має бути в довідковому документі, який вставляється в кожен відповідний промпт, а не в чаті тритижневої давнини.
Що ви можете зберегти для подальшого пошуку? Історичні нотатки проєкту, специфікації продукту або минулі дослідження можуть зберігатися у структурованому файлі або базі даних. Але одного зберігання недостатньо. Ви повинні точно знати, як система вирішує, який саме фрагмент із цього сховища потрібно витягнути в розмову. Якщо пошук залежить від збігу ключових слів, дещо інше формулювання у вашому промпті може призвести до того, що система витягне не ту сторінку.
Що людина має перевіряти вручну? Коли ціна помилки висока — фінансові показники, медичні висновки, юридичні формулювання, оголошення для клієнтів — не довіряйте пайплайну сліпо. Людина має перевірити, чи використав ШІ правильну версію документа і чи має результат сенс у реальному світі. Модель не зможе сказати вам, що вона щойно процитувала прайс-лист за минулий рік. Вона не знає, який зараз рік, якщо ви не вкажете це в промпті.
Побудова робочого процесу з пріоритетом контексту
Надійна робота ШІ — це здебільшого якісна архітектура інформації. Ось як її побудувати.
Зберігайте сталі правила в довідковому документі. Це ваше єдине джерело істини. Коли правила змінюються, редагуйте лише цей один файл. Не розкидайте інструкції десятками чат-потоків.
Передавайте для виконання завдання лише відповідні частини цього документа. Завантаження стосторічного посібника в промпт — це дорого і створює зайвий шум. Витягуйте лише ті дві сторінки, які мають значення для конкретного запитання. Точність важливіша за обсяг.
Тримайте короткострокові деталі в активному промпті. Якщо ви проводите мозковий штурм назв для допису в блозі про електровелосипеди, згадайте «електровелосипеди» в промпті. Не сподівайтеся, що модель знає, про що ви думаєте, лише тому, що ви згадували про це вчора.
Залучайте людину для перевірки результатів, коли помилки коштують дорого. ШІ ніколи не відчує сорому. Він надішле неправильний рахунок або недоречне перепрошення з тією ж впевненістю, з якою він робить усе інше. Хтось має виконувати роль перевірки на адекватність.
Думайте шарами
Допомагає уявити інформацію ШІ як чотири накладені один на одного шари, кожен з яких має свою надійність і ризики.
Непосередній контекст — це поточний промпт. Він на 100 відсотків під вашим контролем, але лише якщо ви приділите час його написанню. Нечіткі промпти дають нечіткі результати.
Збережений контекст — це інформація, яку ви десь зберегли: вікі Notion, векторна база даних, папка з PDF-файлами. Вона існує, але ШІ не бачить її, поки щось не подолає цю дистанцію.
Вилучений контекст — це дані, які за допомогою логіки пошуку, коду або плагіна потрапляють зі сховища в промпт. Саме тут стається більшість прихованих збоїв. Система може витягнути старий контракт замість зміненого або скриншот замість електронної таблиці.
Людський контекст — це ваше власне судження про те, що є правдою, що важливо, а що виглядає дивно
