מה זה noindex?

ההגדרה הקצרה

noindex הוא כלל שיושב בתגית meta או בכותרת HTTP ומשאיר עמוד מחוץ לאינדקס של מנועי החיפוש ומחוץ לתוצאות.

ל-noindex שתי צורות עם אותה משמעות: תגית meta בתוך העמוד, וכותרת X-Robots-Tag בתשובת השרת. גוגל כותבת שכשהיא סורקת עמוד ומוצאת את הכלל, היא מוציאה אותו מהתוצאות לגמרי, גם אם אתרים אחרים מקשרים אליו. כל מנוע חיפוש שסורק את העמוד קורא את הכלל.

איך noindex עובד

כך שתי הצורות נראות:

<meta name="robots" content="noindex">
X-Robots-Tag: noindex

התגית יושבת ב-HTML של העמוד, והכותרת מגיעה בתשובת השרת, ולכן היא הדרך היחידה עבור מה שאינו HTML: קובצי PDF, תמונות וסרטונים. גוגל מתעדת שהכול כאן לא רגיש לרישיות: השם, הערך והכותרת. וזה לא קורה מיד: העמוד יורד מהתוצאות רק בסריקה הבאה, שלפי גוגל יכולה לאחר בחודשים בעמודים פחות חשובים, וכלי בדיקת הכתובות ב-Search Console מזרז את זה. ומכיוון שהכלל נקרא רק בסריקה, noindex לא חוסך תקציב סריקה: גוגל שולפת את העמוד ורק אז מוותרת עליו.

איך noindex קשור ל-SEO ול-GEO

noindex הוא הכלי המדויק להוצאת עמודים מהתוצאות: עמודי תודה, גרסאות הדפסה, תוצאות חיפוש פנימיות, עמודים שנבנו לקמפיין שנגמר. התשובות של גוגל נשענות על האינדקס, ולכן noindex שולט גם בהן: גוגל מתעדת שכדי לשמש מקור ב-AI Overviews וב-AI Mode העמוד חייב להיות באינדקס, ומותר להציג ממנו קטע טקסט בתוצאות (snippet), ומונה את noindex בין הכלים לשליטה בהופעה שם.

ההבדל בין noindex ל-robots.txt

noindex מוציא עמוד מהתוצאות גם אחרי שהוא כבר נכנס לאינדקס. robots.txt לא יכול לעשות את זה: הוא רק מונע מהסורק להגיע לעמוד מלכתחילה. ומכיוון ש-noindex נקרא רק בסריקה, השילוב “גם חסימה וגם noindex” מבטל את עצמו: הכלל שאף סורק לא מגיע אליו לא קיים.

שאלות על noindex

האם אפשר לשים noindex בתוך robots.txt?

noindex בתוך robots.txt לא עובד, ואצל גוגל הוא הפסיק לעבוד ב-1 בספטמבר 2019: ביולי 2019 גוגל הודיעה שבתאריך הזה היא מפסיקה להריץ את הקוד שמטפל בכללים לא נתמכים בקובץ, ובהם noindex. התיעוד הנוכחי שלה מונה ארבעה שדות נתמכים, user-agent, allow, disallow ו-sitemap, ו-noindex לא ביניהם. שום מנוע אחר לא תיעד תמיכה בכלל הזה מעולם, ולכן שורה כזאת בקובץ היא קישוט.

החלופות שגוגל מנתה באותה הודעה: noindex בתגית meta או בכותרת HTTP, קודי 404 או 410, הגנת סיסמה, Disallow ב-robots.txt, וכלי הסרת הכתובות ב-Search Console.

למה עמוד עם noindex עדיין מופיע בגוגל?

עמוד עם noindex נעלם מהתוצאות רק אחרי שגוגל סורקת אותו מחדש ורואה את הכלל. גוגל כותבת שזה יכול לקחת חודשים, לפי חשיבות העמוד, ואפשר לזרז עם כלי בדיקת הכתובות ב-Search Console.

מה קורה כששמים גם noindex וגם חסימה ב-robots.txt?

noindex יחד עם חסימה ב-robots.txt מבטל את עצמו: גוגל מדגישה שכדי שהכלל יעבוד, אסור שהעמוד יהיה חסום בפני הסורק, כי סורק שלא נכנס לא רואה את הכלל. גם בינג כותבת את זה במילים שלה: היא צריכה לסרוק את העמוד כדי לראות את התגית. הרפלקס של "גם וגם ליתר ביטחון" הוא הדרך הנפוצה ביותר להשאיר עמוד תקוע בתוצאות.

האם בוטים של AI מכבדים noindex?

רק שני מנועים מתעדים מה noindex עושה אצלם. גוגל כותבת שכדי להופיע כמקור ב-AI Overviews וב-AI Mode העמוד חייב להיות באינדקס, כך ש-noindex מוציא אותו גם מהתשובות, ומיקרוסופט מתעדת שאצל בינג noindex גם מסמן שאסור להשתמש בתוכן לאימון מודלי ה-AI שלה.

נכון ליולי 2026, OpenAI, Anthropic ו-Perplexity לא מתעדות התייחסות ל-noindex בכלל: ההחרגות שהן מציעות עוברות דרך robots.txt בלבד.