مارکیٹ پلیس کی SEO ٹیم نے اپنے انڈیکسنگ کے اصول کو دوبارہ لکھا کیونکہ ایک سادہ "3 سے کم لسٹنگز = noindex" کی پالیسی کی وجہ سے کیٹیگری صفحات گوگل سے غائب ہو گئے اور انہیں واپس آنے میں ہفتوں لگ گئے۔ ایک طرفہ "unlock" ریکارڈ شامل کر کے، جو کسی صفحے کو noindex سے index میں منتقل ہونے کی اجازت دیتا ہے لیکن کبھی واپس نہیں، سائٹ نے اس اتار چڑھاؤ کو روک دیا۔

اصل اصول کیوں الٹا پڑ گیا

یہ کلاسیفائیڈ پلیٹ فارم بہت سے کیٹیگری اور لوکیشن صفحات تیار کرتا ہے۔ جب کوئی صفحہ پہلی بار ظاہر ہوتا ہے تو اس میں اکثر صرف چند لسٹنگز ہوتی ہیں، اس لیے ٹیم نے فیصلہ کیا کہ جب تک یہ تین اشیاء کی کم از کم حد (threshold) تک نہ پہنچ جائے، اسے سرچ سے چھپا دیا جائے۔ منطق بالکل سادہ تھی:

  • < 3 لسٹنگز $\rightarrow$ ایک noindex میٹا ٹیگ شامل کریں
  • $\ge$ 3 لسٹنگز $\rightarrow$ ٹیگ ہٹا دیں (انڈیکس کرنے کی اجازت دیں)

شروع میں اس سے کم قدر والے (thin) صفحات کو گوگل کے نتائج سے دور رکھا گیا۔ مسئلہ تب پیدا ہوا جب لسٹنگز کی مدت ختم (expire) ہونے لگی۔ ایک صفحہ جس میں ایک دن پانچ لسٹنگز تھیں، اگلے دن دو پر گر سکتی تھیں، جس سے وہ فوری طور پر دوبارہ noindex ہو جاتا۔ گوگل نے اس پر عمل کیا، یو آر ایل (URL) کو اپنے انڈیکس سے نکال دیا، اور صفحہ اپنی تمام رینکنگ کھو بیٹھا۔ جب نئی لسٹنگ آتی، تو صفحہ دوبارہ انڈیکس کے قابل ہو جاتا، لیکن دوبارہ داخل ہونے کے عمل میں ہفتوں لگ جاتے۔

اس کا نتیجہ ایک مسلسل "آن-آف" سائیکل کی صورت میں نکلا: صفحات انڈیکس میں داخل ہوتے، غائب ہو جاتے، دوبارہ داخل ہوتے، اور اسی طرح سلسلہ چلتا رہتا۔

ایک طرفہ "unlock" حل

بنیادی خامی یہ تھی کہ اس اصول کی کوئی یادداشت (memory) نہیں تھی؛ یہ ہر درخواست پر حد (threshold) کا دوبارہ حساب لگاتا تھا۔ ٹیم نے ایک چھوٹی ڈیٹا بیس ٹیبل—seo_unlocks—تعارف کروایا جو یہ ریکارڈ کرتا ہے کہ کوئی صفحہ پہلی بار تین لسٹنگز کی حد تک کب پہنچا۔ نیا طریقہ کار یہ ہے:

  1. لسٹنگ کی تعداد چیک کریں۔ اگر صفحے پر تین یا اس سے زیادہ فعال لسٹنگز ہیں، تو آگے بڑھیں۔
  2. ایک unlock رو (row) لکھیں۔ seo_unlocks میں اس صفحے کے لیے ایک ریکارڈ درج کریں۔
  3. صفحے کو مستقل طور پر انڈیکس کے قابل سمجھیں۔ اگر بعد میں تعداد تین سے کم بھی ہو جائے، تب بھی unlock رو کی موجودگی صفحے کو noindex کے عمل سے دور رکھتی ہے۔

چونکہ unlock صرف ایک بار لکھا جا سکتا ہے، اس لیے ایک صفحہ "noindex" سے "index" میں منتقل ہو سکتا ہے لیکن کبھی واپس نہیں۔ ٹیم نے حفاظتی اقدامات (safeguards) بھی شامل کیے تاکہ فلٹر شدہ یو آر ایل (مثلاً قیمت کی حد کے ساتھ سرچ کے نتائج) اپنی پیرنٹ کیٹیگریز کے لیے unlocks تخلیق نہ کر سکیں، اور ڈیٹا بیس کی विफलता (failure) سے پوری سائٹ کو کریش ہونے سے بچانے کے لیے ڈیٹا بیس کال کو try/catch بلاک میں لپیٹ دیا۔

کرال بجٹ (crawl budget) اور تھن پیجز کے لیے اس کا کیا مطلب ہے

ایک عام غلط فہمی یہ ہے کہ noindex کرال بجٹ بچاتا ہے۔ گوگل کو اب بھی صفحہ حاصل کرنا، ٹیگ پڑھنا، اور پھر اسے انڈیکس سے نکالنا پڑتا ہے۔ اگر مقصد گوگل کو پورے یو آر ایل پیٹرن کی درخواست کرنے سے روکنا ہے، تو صحیح ٹول robots.txt ہے۔ noindex کا استعمال صرف اس وقت کریں جب آپ چاہتے ہوں کہ گوگل صفحہ دیکھے لیکن اسے سرچ کے نتائج میں دکھائے نہیں۔

ڈائریکٹریز، جاب بورڈز، اور مارکیٹ پلیسز جو بڑی تعداد میں خودکار طور پر تیار شدہ صفحات پر انحصار کرتے ہیں، ان کے لیے سبق واضح ہے: تھن پیج کے اصولوں کو ایک ایسی پرسٹنس لیئر (persistence layer) کے ساتھ جوڑا جانا چاہیے جو یاد رکھے کہ صفحہ کب انڈیکس میں جگہ حاصل کر چکا ہے۔ اس یادداشت کے بغیر، مواد میں عارضی کمی ایک صفحے کو اس کی بنائی ہوئی رینکنگ کھو دینے کا سبب بن سکتی ہے، اور دوبارہ داخل ہونے میں ہفتوں لگ سکتے ہیں۔

خلاصہ

ایک جامد (static) "اگر count < 3 تو noindex" کا اصول ڈائنامک لسٹنگ سائٹس کے لیے SEO میں اتار چڑھاؤ پیدا کرتا ہے۔ ایک طرفہ unlock ریکارڈ شامل کرنے سے اصول کو یادداشت ملتی ہے، جس سے صفحات لسٹنگز میں اتار چڑھاؤ کے باوجود اپنی انڈیکس کی حیثیت حاصل کرنے اور برقرار رکھنے کے قابل ہو جاتے ہیں۔ اسے حقیقی کرال بجٹ کی بچت کے لیے robots.txt کے مناسب استعمال کے ساتھ جوڑیں، اور آپ رینکنگ اور سرور کے وسائل دونوں کا تحفظ کر سکتے ہیں۔