چرا صفحات سایت در گوگل ایندکس نمیشوند؟
خلاصه مطلب
اگر صفحات سایت شما در گوگل ایندکس نمیشوند، این مقاله کامل را بخوانید. با ۱۵ دلیل اصلی ایندکس نشدن صفحات، نحوه بررسی در Google Search Console و روشهای رفع مشکل آشنا شوید.
تصور کنید یک مقاله ۳۰۰۰ کلمهای نوشتهاید، تصاویر را بهینه کردهاید، لینک داخلی ساختهاید و حتی برای آن بکلینک گرفتهاید؛ اما هرچه در گوگل جستجو میکنید، خبری از صفحه نیست.
اولین واکنش بیشتر افراد این است که فکر میکنند مشکل از سئو است.
در حالی که در بسیاری از پروژههایی که بررسی کردهایم، مشکل اصلاً رتبه نبود؛ بلکه صفحه هنوز ایندکس نشده بود.
تا زمانی که گوگل صفحهای را ایندکس نکند، آن صفحه شانس حضور در نتایج جستجو را نخواهد داشت.
در این مقاله قدمبهقدم بررسی میکنیم:
ایندکس چیست؟
تفاوت ایندکس و رتبه چیست؟
چرا گوگل بعضی صفحات را ایندکس نمیکند؟
چطور مشکل را پیدا کنیم؟
چطور آن را برطرف کنیم؟
در پایان نیز یک چکلیست عملی خواهیم داشت تا بتوانید وضعیت سایت خود را بررسی کنید.
ایندکس شدن در گوگل یعنی چه؟
گوگل برای پیدا کردن صفحات سایتها سه مرحله اصلی را انجام میدهد:
Crawling (خزش)
Indexing (ایندکس)
Ranking (رتبهبندی)
ابتدا رباتهای گوگل صفحه را پیدا میکنند.
سپس محتوای آن را تحلیل میکنند.
اگر صفحه ارزشمند باشد، آن را داخل پایگاه داده خود ذخیره میکنند.
به این مرحله Indexing گفته میشود.
بعد از آن، اگر کاربری عبارتی مرتبط جستجو کند، گوگل ممکن است آن صفحه را در نتایج نمایش دهد.تفاوت ایندکس شدن و رتبه گرفتن
یکی از رایجترین اشتباهات صاحبان سایت همین است.
بعضی تصور میکنند اگر صفحه ایندکس شد، حتماً باید رتبه یک گوگل را بگیرد.
در حالی که:
ایندکس شدن یعنی گوگل صفحه را میشناسد.
رتبه گرفتن یعنی گوگل تصمیم گرفته آن صفحه را برای یک عبارت مشخص نمایش دهد.
ممکن است صفحه شما ایندکس شده باشد اما در صفحه دهم نتایج قرار داشته باشد.
همچنین ممکن است اصلاً ایندکس نشده باشد و هیچ شانسی برای نمایش نداشته باشد.
از کجا بفهمیم صفحه ایندکس شده است؟
سادهترین روش استفاده از دستور زیر است:
site:yourdomain.com/page-url
اگر صفحه نمایش داده شد، یعنی ایندکس شده است.اگر نمایش داده نشد، احتمالاً هنوز وارد ایندکس گوگل نشده یا از آن حذف شده است.
روش دقیقتر استفاده از Google Search Console و ابزار URL Inspection است.
در آنجا گوگل دقیقاً اعلام میکند:
صفحه ایندکس شده یا خیر
آخرین زمان Crawl
دلیل ایندکس نشدن
امکان درخواست ایندکس مجدد
دلیل اول: صفحه توسط robots.txt مسدود شده است.
یکی از رایجترین اشتباهات هنگام طراحی سایت، مسدود کردن دسترسی رباتهای گوگل است.
گاهی توسعهدهنده برای جلوگیری از ایندکس نسخه آزمایشی سایت، فایل robots.txt را به شکل زیر تنظیم میکند:
User-agent: *
Disallow: /
اما بعد از انتشار سایت فراموش میکند این تنظیم را حذف کند.
در نتیجه گوگل اصلاً اجازه خزش سایت را ندارد.
مقاله پیشنهادی : فایل Robots.txt چیست و چه کاربردی در سئو دارد
راه حل
فایل robots.txt را بررسی کنید.
نمونه صحیح:
User-agent: *
Disallow:
مستندات رسمی گوگل:
https://developers.google.com/search/docs/crawling-indexing/robots/intro
دلیل دوم: وجود تگ Noindex
یکی از شایعترین دلایل ایندکس نشدن صفحات، استفاده از دستور noindex است.
وقتی در کد HTML صفحه چنین عبارتی وجود داشته باشد:
<meta name="robots" content="noindex">
شما عملاً به گوگل گفتهاید:
لطفاً این صفحه را وارد نتایج جستجو نکن.
این مورد معمولاً بعد از انتقال سایت از محیط تست به سایت اصلی، یا به دلیل تنظیمات اشتباه افزونههای سئو در وردپرس رخ میدهد.
چگونه بررسی کنیم؟
سورس صفحه را باز کنید.
عبارت
noindexرا جستجو کنید.یا در Google Search Console وضعیت صفحه را بررسی کنید.
راهحل
اگر قصد دارید صفحه در نتایج گوگل نمایش داده شود، این تگ را حذف یا به index تغییر دهید.
مستندات رسمی گوگل:
https://developers.google.com/search/docs/crawling-indexing/robots-meta-tag
عالی، از اینجا به بعد دقیقاً مثل یک مقاله منتشرشدنی مینویسم.
دلیل سوم: تنظیمات اشتباه Canonical
یکی از مشکلاتی که کمتر به آن توجه میشود، تنظیم نادرست Canonical است.
تگ Canonical به گوگل میگوید اگر چند صفحه محتوای مشابه دارند، کدام صفحه نسخه اصلی (Canonical) محسوب میشود.
اگر به اشتباه Canonical صفحه A را روی صفحه B قرار دهید، ممکن است گوگل صفحه A را ایندکس نکند و فقط صفحه B را در نتایج نمایش دهد.
نمونه صحیح
<link rel="canonical" href="https://example.com/page-a/">
نمونه اشتباه
صفحه A:
<link rel="canonical" href="https://example.com/page-b/">
در حالی که اصلاً صفحه B موضوع دیگری دارد.
چگونه بررسی کنیم؟
ابزار URL Inspection در Search Console
مشاهده Source صفحه
افزونههای مرورگر مثل Detailed SEO Extension
راهحل
Canonical باید به خودش اشاره کند (Self Canonical) مگر اینکه دلیل مشخصی برای خلاف آن داشته باشید.
اگر صفحات مشابه دارید، فقط نسخه اصلی Canonical باشد.
منبع رسمی گوگل:
https://developers.google.com/search/docs/crawling-indexing/consolidate-duplicate-urls
دلیل چهارم: صفحه در Sitemap وجود ندارد
Sitemap یا نقشه سایت به گوگل کمک میکند صفحات مهم سایت را سریعتر پیدا کند.
نبودن صفحه در Sitemap همیشه باعث ایندکس نشدن نمیشود، اما میتواند فرآیند کشف صفحه را کندتر کند؛ مخصوصاً برای سایتهای جدید.
بررسی
در مرورگر آدرس زیر را باز کنید:
yourdomain.com/sitemap.xml
یا اگر از Rank Math یا Yoast استفاده میکنید، Sitemap را از تنظیمات افزونه بررسی کنید.
در Google Search Console نیز از بخش Sitemaps مطمئن شوید فایل نقشه سایت بدون خطا ثبت شده است.
راهحل
صفحه را داخل Sitemap قرار دهید.
Sitemap را دوباره در Search Console ثبت کنید.
منبع رسمی گوگل:
https://developers.google.com/search/docs/crawling-indexing/sitemaps/overview
دلیل پنجم: صفحه هیچ لینک داخلی ندارد (Orphan Page)
فرض کنید مقالهای منتشر کردهاید اما:
از منو لینکی به آن ندادهاید.
از هیچ مقاله دیگری به آن لینک نکردهاید.
در دستهبندی هم قرار ندارد.
در این حالت گوگل ممکن است اصلاً آن صفحه را پیدا نکند یا خیلی دیر پیدا کند.
به چنین صفحاتی Orphan Page یا صفحه یتیم گفته میشود.
راهحل
برای هر مقاله حداقل:
۳ لینک داخلی از مقالات دیگر دریافت کنید.
۳ لینک داخلی به مقالات مرتبط بدهید.
این موضوع علاوه بر ایندکس شدن، به انتقال اعتبار صفحات نیز کمک میکند.
اگر کسبوکار شما در استان مازندران فعالیت میکند و به دنبال افزایش بازدید از گوگل هستید، پیشنهاد میکنیم صفحه سئو در ساری را نیز مطالعه کنید تا با خدمات و استراتژیهای سئوی محلی بیشتر آشنا شوید.
دلیل ششم: کیفیت پایین محتوا (Thin Content)
گوگل صرفاً به این دلیل که صفحهای وجود دارد، آن را ایندکس نمیکند.
اگر صفحه:
فقط ۱۵۰ کلمه متن داشته باشد که هیچ ارزش معنایی نداره.
تقریباً کپی صفحات دیگر باشد.
هیچ ارزش جدیدی ایجاد نکند.
ممکن است گوگل تصمیم بگیرد آن را ایندکس نکند یا بعداً از ایندکس حذف کند.
در Search Console معمولاً این وضعیت را با عباراتی مانند:
Crawled – currently not indexed
یا
Discovered – currently not indexed
میبینید.
مقاله پیشنهادی : رفع خطای Crawled - Currently Not Indexed
راهحل
قبل از انتشار هر مقاله از خودتان بپرسید:
آیا اگر خودم کاربر بودم، این مقاله را تا آخر میخواندم؟
اگر جواب «نه» است، هنوز آماده انتشار نیست.
برای همین تصمیم گرفتیم مقالههای نارنجیفای فقط برای پر کردن سایت نباشند؛ بلکه واقعاً مشکل کاربر را حل کنند.
دلیل هفتم: محتوای تکراری (Duplicate Content)
اگر چند صفحه تقریباً متن یکسانی داشته باشند، گوگل معمولاً فقط یکی را انتخاب میکند.
راهحل
استفاده صحیح از Canonical
حذف صفحات اضافی
ادغام مقالات مشابه
تولید محتوای منحصربهفرد
راجب این مورد یه یادگاری از اوس کمیل داشته باشید. تجربه شخصی من در این مورد خیلی جالب و موفق بوده. سال 1400 سئو کار یه مجله خبری بودم که خیلی مقالات شبیه به هم داشت. ما با ادغام این مقالات خیلی نتیجه خوبی گرفته بودیم و رشد خیلی شگفت انگیزی داشتیم. این مورد رو خیلی جدی بگیرید چون علاوه بر ایندکس نشدن مشکلات بیشتری هم ممکنه براتون پیش بیاره.
دلیل هشتم: سایت تازه راهاندازی شده است
اگر دامنه شما جدید باشد، طبیعی است که گوگل هنوز همه صفحات را سریع ایندکس نکند.
در این شرایط:
Sitemap ثبت کنید.
لینک داخلی بسازید.
محتوای منظم منتشر کنید.
از چند سایت معتبر لینک طبیعی بگیرید.
معمولاً بعد از مدتی سرعت خزش افزایش پیدا میکند.
مقاله پیشنهادی : Discovered – Currently Not Indexed چیست؟
دلیل نهم: خطاهای سرور (5xx)
اگر هنگام مراجعه ربات گوگل، سرور خطای 500، 502 یا 503 برگرداند، گوگل ممکن است صفحه را ایندکس نکند.
بررسی
بخش Page Indexing در Search Console
گزارشهای هاست
ابزارهایی مثل GTmetrix یا PageSpeed Insights برای بررسی در دسترس بودن صفحه
راهحل
رفع خطاهای سرور
استفاده از هاست پایدار
بررسی لاگهای سرور
دلیل دهم: سرعت بسیار پایین سایت
اگر بارگذاری صفحه بیش از حد طول بکشد، گوگل ممکن است خزش را محدود کند؛ بهخصوص در سایتهای بزرگ.
راهکارها:
فشردهسازی تصاویر
استفاده از کش
فعال کردن CDN در صورت نیاز
کاهش حجم فایلهای CSS و JavaScript
استفاده از فرمت WebP برای تصاویر
عالی، از اینجا به بعد وارد دلایلی میشویم که معمولاً کمتر دربارهشان صحبت میشود، اما در پروژههای واقعی سئو زیاد با آنها برخورد میکنیم.
دلیل یازدهم: صفحه هنوز توسط گوگل Crawl نشده است
گاهی اوقات هیچ مشکلی در سایت وجود ندارد، اما گوگل هنوز فرصت نکرده است صفحه را بررسی (Crawl) کند.
این موضوع بیشتر در سایتهای جدید یا صفحاتی که تازه منتشر شدهاند اتفاق میافتد.
در گزارش Page Indexing ممکن است با وضعیت زیر روبهرو شوید:
Discovered – currently not indexed
یعنی گوگل صفحه را پیدا کرده است، اما هنوز آن را بررسی نکرده است.
چرا این اتفاق میافتد؟
سایت تازه راهاندازی شده است.
تعداد صفحات سایت زیاد است.
بودجه خزش (Crawl Budget) محدود است.
سرور در زمان مراجعه گوگل کند بوده است.
راهحل
صفحه را در Sitemap قرار دهید.
از صفحات مهم سایت به آن لینک داخلی بدهید.
از ابزار URL Inspection برای درخواست Crawl مجدد استفاده کنید.
از انتشار تعداد زیادی صفحه بیکیفیت در یک روز خودداری کنید.
نکته مهم: درخواست ایندکس تضمین نمیکند که گوگل صفحه را ایندکس کند؛ فقط از گوگل میخواهید زودتر آن را بررسی کند.
دلیل دوازدهم: صفحه به اشتباه Soft 404 تشخیص داده شده است
یکی از خطاهایی که بسیاری از مدیران سایت را گیج میکند، Soft 404 است.
در این حالت صفحه از نظر فنی کد 200 OK برمیگرداند، اما گوگل تشخیص میدهد که محتوای آن عملاً ارزشی ندارد یا شبیه یک صفحه خطاست.
مثلاً:
صفحه فقط نوشته است: «محصول یافت نشد.»
صفحه تقریباً خالی است.
محتوای بسیار کوتاه و بیارزش دارد.
چگونه بررسی کنیم؟
در Search Console از بخش Page Indexing یا Pages میتوانید وضعیت Soft 404 را مشاهده کنید.
راهحل
محتوای صفحه را کامل کنید.
اگر صفحه واقعاً حذف شده است، از 404 یا 410 واقعی استفاده کنید.
اگر صفحه جایگزین دارد، ریدایرکت 301 انجام دهید.
دلیل سیزدهم: استفاده بیش از حد از JavaScript
امروزه بسیاری از سایتها با فریمورکهایی مثل React، Vue یا Angular ساخته میشوند.
اگر محتوای اصلی صفحه فقط بعد از اجرای JavaScript نمایش داده شود، ممکن است گوگل در پردازش آن با تأخیر یا مشکل مواجه شود.
این موضوع همیشه باعث ایندکس نشدن نمیشود، اما میتواند فرایند را دشوارتر کند.
چگونه بررسی کنیم؟
ابزار URL Inspection در Search Console
ابزار Rich Results Test
مشاهده نسخه Render شده صفحه
راهحل
تا حد امکان محتوای اصلی را در HTML اولیه قرار دهید.
از Server-Side Rendering یا Static Rendering در صورت نیاز استفاده کنید.
مطمئن شوید فایلهای JavaScript توسط robots.txt مسدود نشدهاند.
دلیل چهاردهم: مشکلات امنیتی سایت
اگر گوگل تشخیص دهد سایت شما:
بدافزار دارد.
هک شده است.
کاربران را به صفحات مخرب هدایت میکند.
ممکن است ایندکس شدن صفحات را متوقف کند یا حتی صفحات موجود را از نتایج حذف کند.
نشانهها
پیام امنیتی در Search Console
هشدار مرورگر Chrome
افت شدید تعداد صفحات ایندکس شده
راهحل
اسکن کامل سایت
حذف فایلهای مخرب
بهروزرسانی وردپرس، قالب و افزونهها
تغییر رمزهای عبور
درخواست بازبینی امنیتی از گوگل پس از رفع مشکل
دلیل پانزدهم: کیفیت کلی سایت پایین است
گاهی مشکل فقط یک صفحه نیست؛ بلکه گوگل ارزیابی میکند که کل سایت ارزش کافی برای ایندکس سریع همه صفحات ندارد.
این معمولاً زمانی رخ میدهد که سایت:
تعداد زیادی مقاله کوتاه و تکراری دارد.
ساختار لینک داخلی ضعیفی دارد.
صفحات زیادی بدون بازدید و بدون لینک دارد.
محتوای آن ارزش افزوده کمی نسبت به رقبا ارائه میدهد.
راهحل
به جای انتشار روزانه چند مقاله ضعیف، روی انتشار محتوای عمیق و کاربردی تمرکز کنید.
برای مثال، همین مقالهای که در حال خواندن آن هستید قرار است علاوه بر توضیح دلایل، راهحل عملی، چکلیست، تصاویر، FAQ و منابع رسمی گوگل را هم در اختیار کاربر قرار دهد. این همان چیزی است که میتواند کیفیت کلی سایت را در بلندمدت افزایش دهد.
✅ چکلیست عیبیابی ایندکس نشدن صفحات
قبل از اینکه درخواست ایندکس مجدد ارسال کنید، این موارد را بررسی کنید:
| مورد بررسی | وضعیت |
|---|---|
| صفحه در فایل Sitemap وجود دارد | ☐ |
| فایل robots.txt مانع خزش صفحه نشده است | ☐ |
تگ noindex روی صفحه وجود ندارد | ☐ |
| تگ Canonical به صفحه صحیح اشاره میکند | ☐ |
| صفحه از حداقل ۳ صفحه دیگر لینک داخلی دریافت کرده است | ☐ |
| محتوای صفحه کامل، کاربردی و منحصربهفرد است | ☐ |
| صفحه Duplicate Content نیست | ☐ |
| خطاهای 4xx یا 5xx ندارد | ☐ |
| سرعت بارگذاری صفحه مناسب است | ☐ |
| صفحه در Google Search Console بررسی شده است | ☐ |
| در صورت نیاز درخواست Indexing ارسال شده است | ☐ |
نکته: اگر تمام موارد بالا را بررسی کردهاید و هنوز صفحه ایندکس نشده است، کمی صبور باشید. گوگل زمان مشخصی برای ایندکس کردن صفحات اعلام نمیکند و ممکن است این فرآیند از چند ساعت تا چند هفته طول بکشد.
بهترین روش این است که به جای حدس زدن، از Google Search Console کمک بگیرید و وضعیت صفحه را بررسی کنید. سپس با استفاده از چکلیستی که در این مقاله ارائه شد، مشکلات را یکییکی برطرف کنید.
به خاطر داشته باشید که ایندکس شدن اولین قدم برای دیده شدن در گوگل است، نه آخرین قدم. بعد از ایندکس شدن، کیفیت محتوا، تجربه کاربری، لینکسازی داخلی و اعتبار سایت تعیین میکنند که صفحه شما در چه جایگاهی از نتایج جستجو نمایش داده شود.
منابع رسمی گوگل که در این مقاله استفاده شدند
Google Search Essentials (Technical requirements)
https://developers.google.com/search/docs/essentials/technicalHow Crawling Works
https://developers.google.com/search/docs/crawling-indexingURL Inspection Tool
https://support.google.com/webmasters/answer/9012289Page Indexing Report
https://support.google.com/webmasters/answer/7440203Robots.txt Documentation
https://developers.google.com/search/docs/crawling-indexing/robots/introRobots Meta Tag
https://developers.google.com/search/docs/crawling-indexing/robots-meta-tagCanonical URLs
https://developers.google.com/search/docs/crawling-indexing/consolidate-duplicate-urlsXML Sitemaps
https://developers.google.com/search/docs/crawling-indexing/sitemaps/overview
مقالاتی که احتمالا برایتان جالب است :
کنونیکال چیست ؟ آموزش کامل + رفع مشکلات رایج
جمعبندی و نتیجهگیری
ایندکس نشدن صفحات همیشه به معنای وجود یک مشکل بزرگ در سایت نیست. گاهی یک تنظیم ساده مانند noindex، یک Canonical اشتباه یا حتی نبودن لینک داخلی باعث میشود گوگل صفحه شما را وارد نتایج جستجو نکند. بهترین روش این است که به جای حدس زدن، از Google Search Console کمک بگیرید و وضعیت صفحه را بررسی کنید. سپس با استفاده از چکلیستی که در این مقاله ارائه شد، مشکلات را یکییکی برطرف کنید.
ثبت نظر جدید
هنوز نظری ثبت نشده است. اولین نفر باشید!