OpenAI پس از نه ماه پروژه Atlas را تعطیل کرد. این پروژه تلاشی جاهطلبانه برای ساخت مرورگری بود که بهطور خاص برای عاملهای هوش مصنوعی (AI agents) طراحی شده بود — مکانی که در آن نرمافزارها میتوانستند بدون انتظار برای ورودی انسان، وارد وبسایتها شوند، فرمها را پر کنند و وظایف وب را اجرا کنند. اکنون این قابلیتها در حال انتقال به اپلیکیشن دسکتاپ OpenAI و یک افزونهی Chrome هستند. این آزمایش به پایان رسید، اما درس آن تلخ و روشن است: کاربران اپلیکیشن دیگری نمیخواهند؛ آنها میخواهند اپلیکیشنهایی که در حال حاضر استفاده میکنند، هوشمندتر شوند.
تلهی مرورگر مستقل
Atlas برای انسانها نبود، بلکه برای عاملها بود. در تئوری، این جداسازی منطقی به نظر میرسید. یک محیط پاک و مرتب میتوانست کنترل کامل یک هوش مصنوعی را بر صفحه نمایش فراهم کند، بدون اینکه با افزونههای موجود، بوکمارکهای شلوغ یا اسکریپتهای متداخل درگیر شود. عامل میتوانست آزادانه پیمایش کند، احراز هویت را انجام دهد و صفحات وب را بدون برخورد با عادتهای مرور انسانی دستکاری کند.
اما کاربران در محیطهای پاک و مرتب زندگی نمیکنند. رمزهای عبور، کوکیهای نشست (session cookies)، فرآیندهای احراز هویت دو مرحلهای و حافظهی عضلانی آنها درون Chrome، Edge یا Safari قرار دارد. درخواست از کسی برای باز کردن یک مرورگر جداگانه تا یک هوش مصنوعی بتواند از طرف او کار کند، یک مانع فوری ایجاد میکند. تعویض زمینه (Context switching) هزینهبر است. وقتی در حال مدیریت بیست تب مختلف برای تحقیق، ایمیل و مدیریت پروژه هستید، آخرین چیزی که میخواهید این است که یک وظیفه را در یک محیط ایزولهی (sandbox) ناآشنا کپی کنید، فقط برای اینکه یک عامل بتواند آن را انجام دهد. جریان کار قطع میشود و صبر کاربر تمام میشود.
موضوعی به روزمرگیِ گزارش هزینهها را در نظر بگیرید. یک کارمند معمولی نیاز دارد رسیدها را از Gmail استخراج کند، آنها را با ورودیهای تقویم مطابقت دهد و مجموعها را در یک پورتال شرکتی وارد کند. در Atlas، این به معنای سپردن اطلاعات ورود به یک مرورگر ناآشنا و امیدواری به این بود که عامل، هر سه سرویس را بهدرستی مدیریت کند. اما در Chrome، یک افزونه میتواند تب Gmail را که از قبل باز است بخواند، به تب Calendar در کنار آن ارجاع دهد و در حین اینکه کاربر هر ورودی را نظارت میکند، به پر کردن فرم پورتال کمک کند. کاربر هرگز از صندلی خود، چه برسد به مرورگر اصلیاش، تکان نمیخورد. این تفاوت در اصطکاکهای روزمره، همان تفاوت بین ابزاری است که مردم تحمل میکنند و ابزاری که رهایش میکنند.
اعتماد مستلزم شفافیت است
Atlas همچنین یک مشکل عمیقتر را برجسته کرد. عاملهای کاملاً خودگردان هنوز به اندازه کافی قابل اعتماد نیستند و مردم این را میدانند. وقتی یک هوش مصنوعی با هویت شما وارد یک بانک میشود، یک فرم مالیاتی را ارسال میکند یا یک پرواز را رزرو میکند، شما میخواهید ببینید که دقیقاً چه کاری انجام میدهد. Atlas عامل را در کانتینر مخصوص به خودش ایزوله کرده بود. وقتی چیزی از دید خارج باشد، اغلب از ذهن هم خارج میشود و در این مورد، این کار به جای ایجاد اعتماد، باعث از بین رفتن آن شد.
عاملها هنوز ممکن است دکمهها را اشتباه بخوانند، در فیلدهای فرم دچار توهم شوند و در مقابل CAPTCHAها گیر کنند. وقتی این اتفاق در یک مرورگر «جعبه سیاه» (black-box) رخ میدهد که شما هرگز از آن استفاده نمیکنید، این شکست، بیگانه و غیرقابل اعتماد به نظر میرسد. OpenAI با انتقال قابلیتها به یک افزونهی Chrome، عامل را به خط دید عادی کاربر میآورد. افزونه میتواند قبل از خرید مکث کند و تاییدیه بخواهد. میتواند فیلدی را که در مورد آن مطمئن نیست، برجسته کند. میتواند به کاربر اجازه دهد وقتی کار حساس شد، کنترل اوضاع را به دست بگیرد. اعتماد یکباره اعطا نمیشود؛ بلکه از طریق تعاملات مکرری ساخته میشود که در آن انسان همچنان مسئول و در کنترل باقی میماند.
تیمهای امنیتی نیز این موضوع را حس میکنند. شرکتها سیاستهای مرورگر را مدیریت میکنند، افزونهها را در لیست سفید قرار میدهند و مجوزهای ابزارهای داخل Chrome یا Edge را بازرسی میکنند. یک مرورگر مستقل مانند Atlas خارج از آن اکوسیستم قرار میگیرد. بخشهای IT نمیتوانند بهراحتی سیاستهای امنیتی استاندارد را روی آن اعمال کنند. با تغییر مسیر به سمت یک افزونهی Chrome، OpenAI وارد محیطی میشود که چارچوبهای انطباق و مدلهای مجوزدهی از قبل در آن وجود دارند. اگر قرار باشد این ابزار روزی در شرکتهای واقعی مورد استفاده قرار گیرد، این موضوع بسیار حیاتی است.
سه قانون محصول که اهمیت دارند
مرگ Atlas تنها پس از نه ماه، سه قانون سخت را برای هر کسی که در حال ساخت ابزارهای هوش مصنوعی است، تقویت میکند.
آشنایی با پلتفرم بر نوآوری غلبه میکند. از کاربران نخواهید که محیط خود را تغییر دهند. به GitHub Copilot نگاه کنید. این ابزار از توسعهدهندگان نخواست که IDE خود را ترک کنند؛ بلکه در داخل VS Code، IntelliJ و NeoVim ظاهر شد. به همین دلیل بود که ماندگار شد. Atlas این موضوع را نادیده گرفت. سازندگان باید در جایی که کاربران هر روز فعالیت میکنند، با آنها ملاقات کنند. اگر مخاطبان شما در Slack حضور دارند، یک ادغام (integration) برای Slack بسازید. اگر آنها در Chrome مرور میکنند، یک افزونه بسازید. هدف، داشتن منحنی یادگیری صفر است، نه یک رابط کاربری جدید برای یادگیری.
کاهش اصطکاک غیرقابل مذاکره است. هر مرحله اضافی برای دانلود، ثبتنام یا مهاجرت، نرخ پذیرش را از بین میبرد. نصب یک افزونه Chrome تنها دو کلیک و ده ثانیه زمان میبرد. دانلود یک مرورگر جدید، انتقال بوکمارکها، تغییر تنظیمات پیشفرض و تنظیم مجدد گردشهای کاری، چندین برابر تلاش و توجه بیشتری میطلبد. بهترین ویژگیهای هوش مصنوعی مانند ارتقای نرمافزاری به نظر میرسند که کاربران از قبل با آن خو گرفتهاند، نه نرمافزاری جدید که نیاز به مدیریت داشته باشد.
اعتماد نیازمند نقاط کنترل شفاف است. کاربران به دنبال محدودیتهای ایمنی هستند، نه فقط خودمختاری. به این فکر کنید که Grammarly چگونه یک مشکل را زیر آن خط میکشد و منتظر میماند تا شما آن را تایید یا نادیده بگیرید. در نظر بگیرید که 1Password تنها زمانی فیلد رمز عبور را پر میکند که شما آگاهانه روی آیکون کلیک کنید. ابزارهای موفق، منطق خود را آشکار کرده و نقاط بازرسی ارائه میدهند. عامل (agent) باید به گردش کار کمک کند، نه اینکه آن را برباید. Atlas با ترکیب یک محیط جدید با خودمختاری پرریسک، خیلی زود اعتماد بیش از حدی طلب کرد. این ابزار مستلزم جهشی دوگانه بود که اکثر مردم آمادگی انجام آن را نداشتند.
بازار هنوز در حال تنظیم شدن است
صنعت گستردهتر همچنان در تعقیب رویای یک عامل کاملاً خودمختار است که جایگزین کل اپلیکیشنها شود. استارتاپها مرتباً «کارمندان هوش مصنوعی» را تبلیغ میکنند که وظایف شغلی کامل را انجام میدهند در حالی که انسان کناری مینشیند. Atlas ثابت میکند که زمانبندی اشتباه است. مردم آماده نیستند گردشهای کاری حساس را به فرآیندهای نادیدهای که در انزوا اجرا میشوند، واگذار کنند. آنها خواهان کمکی هستند که در مجموعه ابزارهای فعلیشان تعبیه شده باشد و وظایف خاصی را تحت نظارت آنها انجام دهد.
این در تاریخ محاسبات غیرمعمول نیست. صفحات گسترده (Spreadsheets) یکشبه جایگزین حسابداران نشدند؛ آنها دفاتر کل موجود را دیجیتالی کردند. Slack بلافاصله ایمیل را از بین نبرد؛ بلکه آن را جذب و هدایت کرد. فناوری جدید زمانی موفق میشود که به عادتهای قدیمی پیوند میخورد، نه زمانی که میخواهد آن عادتها را بازنویسی کند. Atlas سعی کرد خودِ مرورگر را جایگزین کند، و مرورگر پیروز شد.
آنچه در ادامه میآید
OpenAI اکنون بر یکپارچگی بیشتر و نظارت انسانی دقیقتر تمرکز کرده است. این عبارت ممکن است رسمی و شرکتی به نظر برسد، اما معنای عملی آن ساده است: عامل در داخل گردش کار عادی شما زندگی خواهد کرد و شما کنترل امور را در دست خواهید داشت. افزونه Chrome به عامل اجازه میدهد آنچه را که شما میبینید، ببیند. اپلیکیشن دسکتاپ بدون اینکه مجبور باشید صفحه فعلی خود را ترک کنید، کمک ارائه میدهد. این تغییر نشان میدهد که عامل برنده، آن کسی نخواهد بود که در انزوا بیشترین کار را انجام میدهد؛ بلکه عاملی خواهد بود که به طبیعیترین شکل با گردشهای کاری پیچیده و انسانیِ موجود، سازگار میشود.
عاملهای هوش مصنوعی موفق در آینده نزدیک، محدود (narrow) خواهند بود، نه گسترده. آنها ایمیلها را در داخل Gmail دستهبندی میکنند، فایلهای PDF را در نمایشگر فعلی شما خلاصه میکنند و فرمها را در تب فعلی مرورگرتان پر میکنند. آنها قبل از کلیک کردن، سوال میپرسند. آنها به جای اینکه در یک محیط ایزوله (sandbox) پنهان شکست بخورند، دقیقاً همانجایی که میتوانید اصلاحشان کنید، به شکلی آشکار و محترمانه دچار خطا میشوند.
پایان Atlas...
