מסיבה לא ברורה אני עדיין מוצא אתרים מקודמים (לפחות לפי הקרדיט בתחתית האתר) אשר חלק מהקישורים בהם מקשרים עם WWW, חלק בלי WWW, חלק מקשרים לעמוד הבית בצורת index.php וחלק מקשרים לעמוד הבית בצורת דומיין נקי.
הא"ב של קידום אתרים הוא בנייה נכונה של שלד, לא יכול להיות שקישורים נכנסים לאתר יהיו לדומיין הנקי של האתר וקישורים פנימיים יובילו לעמוד האינדקס.
למה הדבר מזיק?
כמו שכל מקדם אתרים יודע, גוגל לא אוהב "כפל תוכן", כלומר תוכן זהה בעמודים/אתרים שונים.
כאשר ישנו מצב כמו שאני מאתר הרי שגוגל מזהה את אותו התוכן בדיוק (הרי זה אותו עמוד) אך בכתובות שונות.
הדבר גורם לבלבול של מנוע החיפוש והוא מתקשה להחליט מה מהכתובות היא הנכונה.
למה גוגל לא אוהב כפל תוכן?
העניין העיקרי של גוגל הוא למנוע ספאם וגניבת תוכן (וכמובן רלוונטיות).
כאשר גוגל מזהה את אותו התוכן באתרים שונים הוא מניח שהאתר בו הזחלן זיהה את התוכן לראשונה הוא מקור התוכן (פבל כותב על הבעייתיות של השיטה בפוסט שלו בנושא רשתות חברתיות).
גוגל בעצם מונעים עלייה של מספר אתרים או עמודים עם אותו התוכן בתוצאות החיפוש (הרי אם לא היה מנגנון סינון לתוכן כפול העמוד הראשון בגוגל היה מכיל מספר אתרים עם אותו התוכן).
איך ניתן לפתור את הבעיה?
במידה ורוב הקישורים הנכנסים לאתר מקשרים לכתובת הדומיין הנקי (כפי שאמור להיות) כל מה שצריך לעשות זה לשנות את הקישורים הפנימיים באתר שיובילו גם הם לדומיין הנקי במקום לINDEX.
במידה ודווקא הקישורים הנכנסים מובילים לעמוד הINDEX יש להשתמש בהפניה 301 על מנת להפנות מהכתובת INDEX לכתובת הנקייה של האתר (לדוגמה www.domain.com).
והמלצה קטנה לכל מי שמתעסק ב"קידום אתרים" (והגרשיים בכוונה), עבודת הקידום היא לא רק השגת קישורים נכנסים לאתר עם Anchor Text מתאים.
בניית שלד נכון וקידום ONSITE הוא החלק החשוב (ופה שוב אציין לצערי שלא תמיד הדבר נכון לגבי גוגל ישראל, אולי שמישהו ירים את הכפפה ויעשה משהו עם האלגוריתם הישראלי כבר?).