تیم SEO این بازار، قوانین ایندکس خود را بازنویسی کرد؛ زیرا سیاست ساده‌ی «کمتر از ۳ آگهی = noindex» باعث شده بود صفحات دسته‌بندی از گوگل ناپدید شوند و بازگشت آن‌ها هفته‌ها طول بکشد. با افزودن یک رکورد «بازگشایی» (unlock) یک‌طرفه که اجازه می‌دهد یک صفحه از حالت noindex به index تغییر وضعیت دهد اما هرگز برنگردد، سایت از این نوسان جلوگیری کرد.

چرا قانون اصلی نتیجه معکوس داشت

این پلتفرم نیازمندی‌ها (classifieds)، صفحات زیادی بر اساس دسته‌بندی و مکان تولید می‌کند. وقتی یک صفحه برای اولین بار ظاهر می‌شود، اغلب تنها تعداد کمی آگهی دارد، بنابراین تیم تصمیم گرفت آن را تا زمانی که به حداقل آستانه‌ی سه مورد برسد، از جستجو پنهان کند. منطق کار ساده بود:

  • کمتر از ۳ آگهی ← افزودن تگ متای noindex
  • ۳ آگهی یا بیشتر ← حذف تگ (اجازه ایندکس شدن)

در ابتدا، این کار باعث می‌شد صفحات کم‌محتوا (thin) و کم‌ارزش از نتایج گوگل حذف شوند. اما مشکل زمانی بروز کرد که مهلت آگهی‌ها تمام می‌شد. صفحه‌ای که یک روز دارای پنج آگهی بود، ممکن بود روز بعد به دو آگهی کاهش یابد و بلافاصله به حالت noindex بازگردد. گوگل این دستور را اجرا می‌کرد، URL را از ایندکس خود حذف می‌کرد و صفحه هر رتبه‌ای را که کسب کرده بود از دست می‌داد. وقتی آگهی جدیدی می‌آمد، صفحه دوباره قابل ایندکس شدن می‌شد، اما فرآیند ورود مجدد به گوگل هفته‌ها طول می‌کشید.

نتیجه، یک چرخه‌ی مداوم «روشن-خاموش» بود: صفحات وارد ایندکس می‌شدند، ناپدید می‌شدند، دوباره وارد می‌شدند و همین‌طور ادامه داشت.

راهکار «بازگشایی» یک‌طرفه

نقص اصلی این بود که قانون هیچ حافظه‌ای نداشت؛ یعنی در هر درخواست، آستانه را دوباره محاسبه می‌کرد. تیم یک جدول کوچک در پایگاه داده به نام seo_unlocks معرفی کرد که ثبت می‌کند یک صفحه اولین بار چه زمانی به حد نصاب سه آگهی رسیده است. گردش کار جدید به این صورت است:

  1. بررسی تعداد آگهی‌ها. اگر صفحه سه آگهی فعال یا بیشتر دارد، ادامه دهید.
  2. ثبت ردیف بازگشایی. یک رکورد برای آن صفحه در seo_unlocks درج کنید.
  3. در نظر گرفتن صفحه به عنوان همیشه قابل ایندکس. حتی اگر تعداد آگهی‌ها بعداً به کمتر از سه برسد، وجود ردیف بازگشایی باعث می‌شود صفحه از جریان noindex خارج بماند.

از آنجایی که عملیات بازگشایی (unlock) فقط یک بار قابل ثبت است، یک صفحه می‌تواند از حالت «noindex» به «index» تغییر وضعیت دهد اما هرگز برنگردد. تیم از اقدامات حفاظتی استفاده کرد تا URLهای فیلتر شده (مثلاً نتایج جستجو با بازه قیمتی خاص) نتوانند برای دسته‌بندی‌های اصلی خود رکورد بازگشایی ایجاد کنند، و فراخوانی پایگاه داده را در یک بلوک try/catch قرار داد تا از خرابی کل سایت در صورت بروز خطا در دیتابیس جلوگیری کند.

این موضوع چه معنایی برای بودجه خزش و صفحات کم‌محتوا دارد

یک باور اشتباه رایج این است که noindex باعث صرفه‌جویی در بودجه خزش (crawl budget) می‌شود. گوگل همچنان باید صفحه را فراخوانی کند، تگ را بخواند و سپس آن را از ایندکس حذف کند. اگر هدف این است که از درخواست گوگل برای یک الگوی URL کامل جلوگیری کنید، ابزار صحیح robots.txt است. تنها زمانی از noindex استفاده کنید که می‌خواهید گوگل صفحه را ببیند اما آن را در نتایج جستجو نمایش ندهد.

برای دایرکتوری‌ها، سایت‌های کاریابی و بازارهای آنلاین که به تعداد زیادی صفحات خودکار تولید شده متکی هستند، درس واضح است: قوانین مربوط به صفحات کم‌محتوا باید با یک لایه ماندگاری (persistence layer) همراه باشند که به یاد داشته باشد یک صفحه چه زمانی جایگاه خود را در ایندکس به دست آورده است. بدون این حافظه، افت موقت محتوا می‌تواند باعث شود یک صفحه رتبه‌ای را که کسب کرده بود از دست بدهد و ورود مجدد به گوگل هفته‌ها طول بکشد.

نتیجه‌گیری

یک قانون ایستا مثل «اگر تعداد < ۳ بود، پس noindex» باعث بی‌ثباتی SEO در سایت‌های آگهی پویا می‌شود. افزودن یک رکورد بازگشایی یک‌طرفه به این قانون حافظه می‌دهد و به صفحات اجازه می‌دهد حتی در زمان نوسان تعداد آگهی‌ها، وضعیت ایندکس خود را کسب کرده و حفظ کنند. این کار را با استفاده صحیح از robots.txt برای صرفه‌جویی واقعی در بودجه خزش ترکیب کنید تا بتوانید هم از رتبه‌ها و هم از منابع سرور محافظت کنید.