בדקתי ב-4,608 מבחנים מה גורם ל-AI לבחור עמוד בעברית כמקור. אלה התוצאות
פורסם 16.8.2026
ביולי 2026 פרסם חוקר ה-SEO דן פטרוביץ’ ניסוי שעורר הרבה רעש בתחום: הוא בדק, בעשרות אלפי הצבעות מבוקרות, אילו שינויים בטקסט גורמים למודל AI לבחור עמוד כמקור לתשובה. הוא דיווח על 31 גורמים מובהקים, אבל את הרשימה עצמה לא פרסם. היא נמכרת כמוצר בתשלום.
אז במקום לנחש מה יש ברשימה, ערכתי את הניסוי בעצמי. על עמודים בעברית, בשיטה שלו, עם המספרים גלויים.
איך הניסוי עבד
בניתי 8 עמודים עסקיים סינתטיים בעברית, בנישות של עורכי דין ועסקים קטנים: גירושין, ביטוח, ירושות, דיני עבודה, דולה, רואה חשבון, יועץ משכנתאות ומרפאת שיער. כל עמוד נכתב ניטרלי בכוונה: בלי מספרים, בלי טבלאות, בלי הבטחות, בלי אנגלית.
מכל עמוד בסיס יצרתי 36 גרסאות, כל גרסה עם שינוי אחד ויחיד: גרסה עם קרדנציאלים, גרסה עם טבלת השוואה, גרסה עם סימני קריאה, גרסה בלשון סביל, וכן הלאה. מערכת בקרה בדקה שכל גרסה שונה מהבסיס רק בגורם הנמדד ובשום דבר אחר.
ואז הגיע השיפוט: שופט AI קיבל בכל פעם זוג עמודים, את הבסיס ואת הגרסה, יחד עם שאלה אמיתית של לקוח, ונדרש לבחור בדיוק עמוד אחד כמקור לתשובה. סדר ההצגה התחלף באופן שיטתי כדי לנטרל את הנטייה הידועה של מודלים להעדיף את מה שהם קוראים ראשון. סך הכול: 4,608 הצבעות על מנוע אחד, ועוד 256 הצבעות אימות על מנוע שני.
נקודה חשובה על אמינות: מהפוסט המקורי של פטרוביץ’ דלפו שלוש זהויות של גורמים, עם המספרים שלהם. השתמשתי בהם כעוגני כיול. אם הניסוי שלי לא היה משחזר אותם, לא הייתם קוראים את הפוסט הזה. כל השלושה שוחזרו, בעברית, ועל שני מנועים.
מה מנצח: עובדות שאפשר לבדוק
הגורמים החזקים ביותר, שניצחו כמעט בכל הצבעה שבה השתתפו:
- קרדנציאלים קונקרטיים: שנות ותק במספר, השכלה, חברות בלשכה, היקף תיקים.
- טענות סמכות עם תוכן: תפקיד בוועדה מקצועית, הרצאות, הופעות בתקשורת.
- נתונים ומספרים בגוף הטקסט, עם שקיפות מחירים בשקלים.
- מבנה שמקל על חילוץ תשובה: טבלת השוואה, בלוק שאלות נפוצות, רשימות, תהליך בשלבים.
- תאריך עדכון טרי, פרטי התקשרות בולטים, המלצות לקוחות, ותשובה ישירה כבר בפסקה הראשונה.
ומול זה, הממצא שהכי כדאי להפנים: מלל שנשמע סמכותי אבל ריק מתוכן, בסגנון “מחויבות למצוינות” ו”הסטנדרטים הגבוהים בתחום”, לא עזר בכלל במנוע אחד, ובמנוע השני אף הוריד את הסיכוי להיבחר. המנועים לא מתרשמים מהצהרות. הם מתרשמים ממה שאפשר לאמת.
מה מפסיד: הרגלים שכיחים מאוד באתרים ישראליים
הצד השלילי של הטבלה מעניין לא פחות, כי הוא קורא כמו רשימת מלאי של אתרי עסקים בישראל:
- מונחים באנגלית בתוך טקסט עברי. הגורם השלילי הקיצוני ביותר שנמדד: עמודים כאלה כמעט לא נבחרו כמקור אף פעם. גם שם מותג באנגלית במקום בעברית פגע משמעותית.
- קריאה לפעולה אגרסיבית, בסגנון “התקשרו עכשיו, אל תחכו”. כמעט תמיד הפסידה.
- הבטחות גורפות: “הצלחה מובטחת”, “תוצאה בטוחה לכל לקוח”.
- לשון סביל לאורך העמוד.
- משלב דיבורי, סופרלטיבים כמו “הטוב ביותר” ו”המוביל בתחום”, דחיסת מילות מפתח, סימני קריאה מרובים, ואותיות גדולות באנגלית בסגנון CALL NOW.
- קיצור העמוד לתוכן דליל. הגרסה המקוצרת לא ניצחה אפילו הצבעה אחת.
שלוש הפתעות
לפני הריצה רשמתי ניבוי לכל גורם, כדי שלא אוכל לספר לעצמי סיפורים בדיעבד. מתוך 20 ניבויים שהתחייבתי להם, 17 צדקו. שלושת הפספוסים מעניינים במיוחד, כי שלושתם היו גורמים שחשבתי שיזיקו והתברר שעזרו: אזכור ענייני של דחיפות או זמינות מוגבלת, אימוג’ים במידה סבירה, ודווקא שפה זהירה ומסויגת. ההסבר הסביר, ואני מסמן אותו כהשערה ולא כממצא: שלושתם מוסיפים לעמוד טקסטורה אנושית וספציפית, בזמן שהגרסאות המנופחות מוסיפות רק רעש.
מה זה לא אומר
אני מתפרנס ממדידה, אז אדייק גם כשזה פחות זוהר. הניסוי נערך על עמודים סינתטיים, בבחירה כפויה בין שני עמודים, מול שופטי AI צרכניים. הוא לא מדד דירוג בגוגל, לא תנועה ולא פניות. חלק מהגורמים החיוביים הגיעו לניצחון מוחלט, ולכן אי אפשר לדרג אותם זה מול זה. ועדיין, כשמצליבים את התוצאות עם מה שידוע על איך מנועי תשובה בוחרים מקורות, מתקבלת רשימת עריכה מעשית מאוד: יותר עובדות ומבנה, פחות יוקרה ריקה ולחץ מכירתי.
עוד ממצא אחד ששווה שקיפות: הנטייה המפורסמת של מודלים להעדיף את העמוד הראשון שהם קוראים התבררה כמורכבת יותר. כשהחלפתי את התוויות של העמודים, התברר שחלק מההעדפה הזאת הוא בכלל העדפה לאות A. גם את זה מדדתי ותיעדתי, כי מספרים שלא בודקים אותם עד הסוף הם בדיוק הבעיה שהניסוי הזה בא לפתור.
השורה התחתונה לבעלי עסקים
אם יש לכם עמוד שירות או עמוד בית בעברית, העריכה שהניסוי תומך בה נראית כך: פתחו בתשובה ישירה לשאלה שהלקוח באמת שואל. החליפו כל משפט יוקרה בעובדה עם מספר. הוסיפו טבלה, שאלות נפוצות ותאריך עדכון. מחקו את האנגלית מהטקסט העברי, את הסופרלטיבים ואת ההבטחות. וכתבו בלשון פעילה, כמו אדם שמדבר אל אדם.
זה בדיוק סוג הבדיקה שאני מריץ ללקוחות: לא תחושות, מדידה. אם אתם רוצים לראות איפה האתר שלכם עומד מול הגורמים האלה, מוזמנים לפנות אליי דרך האתר.
שאלות נפוצות
מה בעצם נמדד בניסוי?
בכל מבחן הוצגו לשופט AI שני עמודים עסקיים בעברית, זהים לחלוטין פרט לשינוי אחד ויחיד, יחד עם שאלה אמיתית של לקוח. השופט נדרש לבחור בדיוק עמוד אחד שישמש כמקור לתשובה. כששינוי מסוים גורם לעמוד להיבחר הרבה יותר או הרבה פחות מ-50 אחוזים מהמקרים, אחרי נטרול השפעת סדר ההצגה, זה הגורם שנמדד.
האם התוצאות אומרות שהאתר שלי יעלה בדירוג אם אוסיף טבלה?
לא, וחשוב לי לומר את זה ישר. הניסוי מדד בחירת מקור בין שני עמודים בתנאי מעבדה, לא דירוג בגוגל ולא כמות פניות. מה שהוא כן אומר: כשמנוע AI צריך להכריע על איזה עמוד להתבסס, יש מאפייני טקסט שמטים את ההכרעה באופן עקבי ומדיד. זה שכבה אחת מתוך תמונה רחבה יותר של נראות ב-AI.
מה הממצא הכי מפתיע?
שלושה גורמים שניבאתי מראש שיזיקו דווקא עזרו: אזכור דחיפות עניינית, אימוג'ים במידה, ושפה מסויגת וזהירה. לעומת זאת מלל יוקרתי ריק כמו מחויבות למצוינות לא עזר בכלל, ובמנוע אחד אף הזיק. המנועים מתגמלים עובדות שאפשר לבדוק, לא הצהרות.
מה הדבר הראשון שכדאי לי לתקן באתר?
לפי המדידה, שני הצעדים עם היחס הכי טוב של תועלת למאמץ: להחליף כל משפט יוקרה ריק בעובדה קונקרטית עם מספר (שנות ותק, היקף תיקים, הסמכות), ולנקות מהטקסט העברי מונחים באנגלית, סופרלטיבים והבטחות גורפות. בניסוי, עמודים עם מונחים לועזיים בתוך עברית כמעט לא נבחרו כמקור אף פעם.
איך אפשר לדעת איפה האתר שלי עומד מול הגורמים האלה?
אני מריץ בדיקת נראות AI שכוללת בין השאר סריקה של העמודים המרכזיים מול רשימת הגורמים שנמדדו, עם הטקסט הבעייתי המסומן עצמו, לא ציון כללי. אפשר לפנות אליי דרך האתר ואשמח להראות איך זה נראה על האתר שלכם.