OpenAI پس از نه ماه پروژه Atlas را تعطیل کرد. این پروژه تلاشی جاه‌طلبانه برای ساخت مرورگری بود که به‌طور خاص برای عامل‌های هوش مصنوعی (AI agents) طراحی شده بود — مکانی که در آن نرم‌افزارها می‌توانستند بدون انتظار برای ورودی انسان، وارد وب‌سایت‌ها شوند، فرم‌ها را پر کنند و وظایف وب را اجرا کنند. اکنون این قابلیت‌ها در حال انتقال به اپلیکیشن دسکتاپ OpenAI و یک افزونه‌ی Chrome هستند. این آزمایش به پایان رسید، اما درس آن تلخ و روشن است: کاربران اپلیکیشن دیگری نمی‌خواهند؛ آن‌ها می‌خواهند اپلیکیشن‌هایی که در حال حاضر استفاده می‌کنند، هوشمندتر شوند.

تله‌ی مرورگر مستقل

Atlas برای انسان‌ها نبود، بلکه برای عامل‌ها بود. در تئوری، این جداسازی منطقی به نظر می‌رسید. یک محیط پاک و مرتب می‌توانست کنترل کامل یک هوش مصنوعی را بر صفحه نمایش فراهم کند، بدون اینکه با افزونه‌های موجود، بوک‌مارک‌های شلوغ یا اسکریپت‌های متداخل درگیر شود. عامل می‌توانست آزادانه پیمایش کند، احراز هویت را انجام دهد و صفحات وب را بدون برخورد با عادت‌های مرور انسانی دستکاری کند.

اما کاربران در محیط‌های پاک و مرتب زندگی نمی‌کنند. رمزهای عبور، کوکی‌های نشست (session cookies)، فرآیندهای احراز هویت دو مرحله‌ای و حافظه‌ی عضلانی آن‌ها درون Chrome، Edge یا Safari قرار دارد. درخواست از کسی برای باز کردن یک مرورگر جداگانه تا یک هوش مصنوعی بتواند از طرف او کار کند، یک مانع فوری ایجاد می‌کند. تعویض زمینه (Context switching) هزینه‌بر است. وقتی در حال مدیریت بیست تب مختلف برای تحقیق، ایمیل و مدیریت پروژه هستید، آخرین چیزی که می‌خواهید این است که یک وظیفه را در یک محیط ایزوله‌ی (sandbox) ناآشنا کپی کنید، فقط برای اینکه یک عامل بتواند آن را انجام دهد. جریان کار قطع می‌شود و صبر کاربر تمام می‌شود.

موضوعی به روزمرگیِ گزارش هزینه‌ها را در نظر بگیرید. یک کارمند معمولی نیاز دارد رسیدها را از Gmail استخراج کند، آن‌ها را با ورودی‌های تقویم مطابقت دهد و مجموع‌ها را در یک پورتال شرکتی وارد کند. در Atlas، این به معنای سپردن اطلاعات ورود به یک مرورگر ناآشنا و امیدواری به این بود که عامل، هر سه سرویس را به‌درستی مدیریت کند. اما در Chrome، یک افزونه می‌تواند تب Gmail را که از قبل باز است بخواند، به تب Calendar در کنار آن ارجاع دهد و در حین اینکه کاربر هر ورودی را نظارت می‌کند، به پر کردن فرم پورتال کمک کند. کاربر هرگز از صندلی خود، چه برسد به مرورگر اصلی‌اش، تکان نمی‌خورد. این تفاوت در اصطکاک‌های روزمره، همان تفاوت بین ابزاری است که مردم تحمل می‌کنند و ابزاری که رهایش می‌کنند.

اعتماد مستلزم شفافیت است

Atlas همچنین یک مشکل عمیق‌تر را برجسته کرد. عامل‌های کاملاً خودگردان هنوز به اندازه کافی قابل اعتماد نیستند و مردم این را می‌دانند. وقتی یک هوش مصنوعی با هویت شما وارد یک بانک می‌شود، یک فرم مالیاتی را ارسال می‌کند یا یک پرواز را رزرو می‌کند، شما می‌خواهید ببینید که دقیقاً چه کاری انجام می‌دهد. Atlas عامل را در کانتینر مخصوص به خودش ایزوله کرده بود. وقتی چیزی از دید خارج باشد، اغلب از ذهن هم خارج می‌شود و در این مورد، این کار به جای ایجاد اعتماد، باعث از بین رفتن آن شد.

عامل‌ها هنوز ممکن است دکمه‌ها را اشتباه بخوانند، در فیلدهای فرم دچار توهم شوند و در مقابل CAPTCHAها گیر کنند. وقتی این اتفاق در یک مرورگر «جعبه سیاه» (black-box) رخ می‌دهد که شما هرگز از آن استفاده نمی‌کنید، این شکست، بیگانه و غیرقابل اعتماد به نظر می‌رسد. OpenAI با انتقال قابلیت‌ها به یک افزونه‌ی Chrome، عامل را به خط دید عادی کاربر می‌آورد. افزونه می‌تواند قبل از خرید مکث کند و تاییدیه بخواهد. می‌تواند فیلدی را که در مورد آن مطمئن نیست، برجسته کند. می‌تواند به کاربر اجازه دهد وقتی کار حساس شد، کنترل اوضاع را به دست بگیرد. اعتماد یک‌باره اعطا نمی‌شود؛ بلکه از طریق تعاملات مکرری ساخته می‌شود که در آن انسان همچنان مسئول و در کنترل باقی می‌ماند.

تیم‌های امنیتی نیز این موضوع را حس می‌کنند. شرکت‌ها سیاست‌های مرورگر را مدیریت می‌کنند، افزونه‌ها را در لیست سفید قرار می‌دهند و مجوزهای ابزارهای داخل Chrome یا Edge را بازرسی می‌کنند. یک مرورگر مستقل مانند Atlas خارج از آن اکوسیستم قرار می‌گیرد. بخش‌های IT نمی‌توانند به‌راحتی سیاست‌های امنیتی استاندارد را روی آن اعمال کنند. با تغییر مسیر به سمت یک افزونه‌ی Chrome، OpenAI وارد محیطی می‌شود که چارچوب‌های انطباق و مدل‌های مجوزدهی از قبل در آن وجود دارند. اگر قرار باشد این ابزار روزی در شرکت‌های واقعی مورد استفاده قرار گیرد، این موضوع بسیار حیاتی است.

سه قانون محصول که اهمیت دارند

مرگ Atlas تنها پس از نه ماه، سه قانون سخت را برای هر کسی که در حال ساخت ابزارهای هوش مصنوعی است، تقویت می‌کند.

آشنایی با پلتفرم بر نوآوری غلبه می‌کند. از کاربران نخواهید که محیط خود را تغییر دهند. به GitHub Copilot نگاه کنید. این ابزار از توسعه‌دهندگان نخواست که IDE خود را ترک کنند؛ بلکه در داخل VS Code، IntelliJ و NeoVim ظاهر شد. به همین دلیل بود که ماندگار شد. Atlas این موضوع را نادیده گرفت. سازندگان باید در جایی که کاربران هر روز فعالیت می‌کنند، با آن‌ها ملاقات کنند. اگر مخاطبان شما در Slack حضور دارند، یک ادغام (integration) برای Slack بسازید. اگر آن‌ها در Chrome مرور می‌کنند، یک افزونه بسازید. هدف، داشتن منحنی یادگیری صفر است، نه یک رابط کاربری جدید برای یادگیری.

کاهش اصطکاک غیرقابل مذاکره است. هر مرحله اضافی برای دانلود، ثبت‌نام یا مهاجرت، نرخ پذیرش را از بین می‌برد. نصب یک افزونه Chrome تنها دو کلیک و ده ثانیه زمان می‌برد. دانلود یک مرورگر جدید، انتقال بوک‌مارک‌ها، تغییر تنظیمات پیش‌فرض و تنظیم مجدد گردش‌های کاری، چندین برابر تلاش و توجه بیشتری می‌طلبد. بهترین ویژگی‌های هوش مصنوعی مانند ارتقای نرم‌افزاری به نظر می‌رسند که کاربران از قبل با آن خو گرفته‌اند، نه نرم‌افزاری جدید که نیاز به مدیریت داشته باشد.

اعتماد نیازمند نقاط کنترل شفاف است. کاربران به دنبال محدودیت‌های ایمنی هستند، نه فقط خودمختاری. به این فکر کنید که Grammarly چگونه یک مشکل را زیر آن خط می‌کشد و منتظر می‌ماند تا شما آن را تایید یا نادیده بگیرید. در نظر بگیرید که 1Password تنها زمانی فیلد رمز عبور را پر می‌کند که شما آگاهانه روی آیکون کلیک کنید. ابزارهای موفق، منطق خود را آشکار کرده و نقاط بازرسی ارائه می‌دهند. عامل (agent) باید به گردش کار کمک کند، نه اینکه آن را برباید. Atlas با ترکیب یک محیط جدید با خودمختاری پرریسک، خیلی زود اعتماد بیش از حدی طلب کرد. این ابزار مستلزم جهشی دوگانه بود که اکثر مردم آمادگی انجام آن را نداشتند.

بازار هنوز در حال تنظیم شدن است

صنعت گسترده‌تر همچنان در تعقیب رویای یک عامل کاملاً خودمختار است که جایگزین کل اپلیکیشن‌ها شود. استارتاپ‌ها مرتباً «کارمندان هوش مصنوعی» را تبلیغ می‌کنند که وظایف شغلی کامل را انجام می‌دهند در حالی که انسان کناری می‌نشیند. Atlas ثابت می‌کند که زمان‌بندی اشتباه است. مردم آماده نیستند گردش‌های کاری حساس را به فرآیندهای نادیده‌ای که در انزوا اجرا می‌شوند، واگذار کنند. آن‌ها خواهان کمکی هستند که در مجموعه ابزارهای فعلی‌شان تعبیه شده باشد و وظایف خاصی را تحت نظارت آن‌ها انجام دهد.

این در تاریخ محاسبات غیرمعمول نیست. صفحات گسترده (Spreadsheets) یک‌شبه جایگزین حسابداران نشدند؛ آن‌ها دفاتر کل موجود را دیجیتالی کردند. Slack بلافاصله ایمیل را از بین نبرد؛ بلکه آن را جذب و هدایت کرد. فناوری جدید زمانی موفق می‌شود که به عادت‌های قدیمی پیوند می‌خورد، نه زمانی که می‌خواهد آن عادت‌ها را بازنویسی کند. Atlas سعی کرد خودِ مرورگر را جایگزین کند، و مرورگر پیروز شد.

آنچه در ادامه می‌آید

OpenAI اکنون بر یکپارچگی بیشتر و نظارت انسانی دقیق‌تر تمرکز کرده است. این عبارت ممکن است رسمی و شرکتی به نظر برسد، اما معنای عملی آن ساده است: عامل در داخل گردش کار عادی شما زندگی خواهد کرد و شما کنترل امور را در دست خواهید داشت. افزونه Chrome به عامل اجازه می‌دهد آنچه را که شما می‌بینید، ببیند. اپلیکیشن دسکتاپ بدون اینکه مجبور باشید صفحه فعلی خود را ترک کنید، کمک ارائه می‌دهد. این تغییر نشان می‌دهد که عامل برنده، آن کسی نخواهد بود که در انزوا بیشترین کار را انجام می‌دهد؛ بلکه عاملی خواهد بود که به طبیعی‌ترین شکل با گردش‌های کاری پیچیده و انسانیِ موجود، سازگار می‌شود.

عامل‌های هوش مصنوعی موفق در آینده نزدیک، محدود (narrow) خواهند بود، نه گسترده. آن‌ها ایمیل‌ها را در داخل Gmail دسته‌بندی می‌کنند، فایل‌های PDF را در نمایشگر فعلی شما خلاصه می‌کنند و فرم‌ها را در تب فعلی مرورگرتان پر می‌کنند. آن‌ها قبل از کلیک کردن، سوال می‌پرسند. آن‌ها به جای اینکه در یک محیط ایزوله (sandbox) پنهان شکست بخورند، دقیقاً همان‌جایی که می‌توانید اصلاحشان کنید، به شکلی آشکار و محترمانه دچار خطا می‌شوند.

پایان Atlas...