SEO לעידן הסוכנים
בדקתי כמה האתר שלי מוכן לסוכני AI. הציון היה נמוך, והתיקון לקח שעה
ל-Cloudflare יש ציון חדש שמודד אם סוכני AI מסוגלים לקרוא אתר. סרקתי את שלי, גיליתי שאני ברמה הכי נמוכה, ותיקנתי בשורה אחת ב-robots.txt. המספרים שלי אמיתיים; הסטטיסטיקות של קלאודפלייר - שלהם.
בזמן שכל האינטרנט עסוק בלחסום בוטים של AI, אני עשיתי בדיוק הפוך: פתחתי להם את הדלת, ותליתי שלט שאומר ברוכים הבאים.
למה? כי הבעיה שלי הפוכה מהבעיה של רוב האתרים. האתר שלי צעיר, הסמכות שלו בגוגל עדיין נמוכה, וכששואלים מודל שפה "מי מעביר סדנאות AI בישראל" - הוא לא מזכיר אותי. אני רוצה שסוכנים יקראו אותי. כמה שיותר, כמה שיותר בקלות.
ואז גיליתי שיש דרך למדוד את זה.
מה זה Agent Readiness Score
באפריל 2026 קלאודפלייר השיקה ציון שעונה על שאלה אחת: כמה האתר שלך שמיש עבור סוכן AI. לא כמה הוא יפה, לא כמה הוא מהיר - כמה סוכן שמגיע אליו מצליח להבין מה יש בו.
הציון בנוי מרמות. רמה 1 היא נוכחות בסיסית - יש אתר, יש sitemap, בוטים לא חסומים. רמה 2 היא "מודע לבוטים" - האתר מצהיר במפורש מה מותר לעשות עם התוכן שלו. רמה 3 היא תוכן שסוכן יכול לקרוא בפורמט נקי, ורמה 4 היא כבר עולם של יכולות - ממשקים שסוכן יכול להפעיל.
והנתון שגרם לי להבין שיש כאן הזדמנות: מסריקה של קלאודפלייר על 200 אלף הדומיינים הגדולים בעולם, רק כ-4% הצהירו העדפות לבוטים של AI, ורק כ-3.9% יודעים להגיש תוכן בפורמט שנוח לסוכנים. כלומר: כמעט כולם, כולל הגדולים, עדיין לא שם. קל לבלוט.
מה הסריקה מצאה אצלי
הרצתי את הסריקה על evyataryizhak.com ב-20 באוגוסט. התוצאה: Level 1. הרמה הכי נמוכה שיש.
החלק המעניין הוא הפירוט. הנה מה שעבר ומה שנכשל, אחד לאחד:
- עבר: robots.txt תקין שמפנה ל-sitemap. הבוטים של OpenAI, אנת'רופיק ופרפלקסיטי מקבלים תשובה מלאה, אף אחד לא חסום.
- עבר: sitemap.xml מסודר, וגם קובץ llms.txt - תיכף אסביר מה זה.
- נכשל: אין הצהרת Content Signals - שורה ב-robots.txt שאומרת לבוטים מה מותר לעשות עם התוכן. מסתבר שזו הדרישה היחידה שהפרידה אותי מרמה 2.
- נכשל: סוכן שמבקש את העמוד בפורמט Markdown נקי מקבל במקום זה 52 קילובייט של HTML עמוס סקריפטים. יש לו מה ללעוס, אבל זה כמו להגיש מרק בצלחת שטוחה.
- נכשל: אין Link headers - כותרות שמצביעות לסוכן על המפה של האתר עוד לפני שהוא קרא שורת HTML אחת.
האתר שנראה הכי טוב לבני אדם היה, מבחינת סוכן, בקושי קריא. ואף אחד לא שלח לי על זה התראה - כי אין התראות על קהל שפשוט לא מגיע.
התיקון: שורה אחת, ואז עוד שתיים
העלייה לרמה 2 התבררה כזולה להפליא. כל מה שצריך זו הצהרת Content Signals ב-robots.txt. אצלי היא נראית ככה:
User-Agent: *
Content-Signal: search=yes, ai-input=yes
Allow: /
Disallow: /api/שימו לב להחלטה שמסתתרת כאן. search=yes אומר "מותר לאנדקס אותי". ai-input=yes אומר "מותר להשתמש בתוכן שלי בתור חומר גלם לתשובות של AI". רוב בעלי האתרים מתלבטים אם לחסום. אצלי ההתלבטות הפוכה: מודל שמצטט את האתר שלי בתשובה על סדנאות AI זה בדיוק השיווק שאני רוצה. יש גם אות שלישי, ai-train, שקובע אם מותר לאמן על התוכן - אותו השארתי בכוונה לא מוצהר. זו החלטה נפרדת, ולא חייבים להחליט הכל ביום אחד.
ואת ה-Link headers סגרתי בשורה אחת בקוד של השרת - כותרת שמצביעה על llms.txt ועל ה-sitemap:
Link: <https://evyataryizhak.com/llms.txt>; rel="llms-txt", <https://evyataryizhak.com/sitemap.xml>; rel="sitemap"סך הכל, מהסריקה הראשונה ועד שהתיקונים עלו לאוויר: פחות משעה.
רגע, מה זה llms.txt
זה הקובץ שהכי השתלם לי לכתוב, אז מגיע לו הסבר. llms.txt הוא קובץ טקסט פשוט שיושב בכתובת קבועה באתר ומספר למודל שפה, בשפה פשוטה, מי אתה ומה יש באתר: מי בעל הבית, מה השירותים, איפה המאמרים, ומה הגבולות - מה אתה כן מבטיח ומה לא.
אצלי יש בו משהו שאני ממליץ לכל עסק לאמץ: פסקת "מה לא מובטח". כתוב שם במפורש שאני לא מבטיח חיסכון כמותי בזמן בלי מדידה, ושתוצר של האקתון הוא אבטיפוס ולא מערכת. למה לכתוב את זה בקובץ שמיועד למודלים? כי אם מודל הולך לצטט אותי, אני מעדיף שיצטט את הגרסה הזהירה והנכונה, לא גרסה מנופחת שהוא הסיק לבד.
מה נשבר לי בדרך: השיעור מהעותקים הכפולים
אם השורה של Content Signals היא "מה שלא הצהרת, לא קיים", את הגרסה הכואבת של אותו שיעור למדתי שבוע קודם. האתר שלי דו-לשוני, והמדריכים כתובים רק בעברית - אבל השרת הגיש אותם גם בכתובת האנגלית, עם אותו תוכן עברי בדיוק, בלי להגיד לגוגל מי המקור. התוצאה ב-Search Console: 21 כתובות נזרקו כ"עותק משוכפל" - גוגל השווה כל זוג, בחר בעצמו מי הקנוני, וזרק את השני. חצי מעץ המדריכים התחרה בעצמו.
הלקח אחד, והוא חל על הכל: מה שאתה לא מצהיר עליו במפורש, מישהו אחר יחליט בשבילך. קנוניקל שלא הוצהר - גוגל בוחר. העדפות בוטים שלא הוצהרו - כל בוט מחליט לבד. הצהרות הן לא בירוקרטיה, הן הדרך היחידה לשמור על השליטה.
עדכון מאותו לילה: גם Markdown לסוכנים
אחרי שהתיקון הראשון עלה, הרצתי את הסריקה שוב וקיבלתי אישור: עלינו ל-Level 2. ומה שהפריד אותנו מ-Level 3 היה בדיוק דבר אחד - שסוכן שמבקש את העמוד בפורמט Markdown יקבל Markdown. לקלאודפלייר יש לזה מתג בדשבורד שממיר את ה-HTML בקצה, אבל בחרתי לממש את זה בעצמי בקוד: כשמגיעה בקשה עם Accept: text/markdown, השרת מרכיב את העמוד ישירות מקבצי התוכן - אותו טקסט שממנו נבנה ה-HTML, בלי שכבת התרגום באמצע. הסוכן מקבל את המקור, לא גרסה מגורדת.
curl -H "Accept: text/markdown" https://evyataryizhak.com/heמה עדיין לא פתור
- רשומות DNS-AID - שכבת גילוי חדשה דרך רשומות DNS ייעודיות. רלוונטי לרמות הגבוהות, לא דחוף לאתר תדמיתי.
- והדבר החשוב באמת: הציון הזה מודד קריאוּת, לא סמכות. אתר יכול להיות מוכן לסוכנים ברמה 4 ועדיין לא להופיע באף תשובה. מה שגורם למודל להמליץ עליך זה אזכורים במקומות שהוא סומך עליהם - עיתונות, קישורים, תוכן שעונה על שאלות אמיתיות. המוכנות הטכנית היא תנאי הכניסה למגרש. היא לא המשחק.
איפה הייתי מתחיל היום
- להריץ סריקה ב-isitagentready.com. שתי דקות, ותדעו בדיוק איפה אתם עומדים ומה חסר.
- לבדוק ש-robots.txt לא חוסם את הבוטים של AI בטעות. הרבה תבניות ותוספים חוסמים אותם כברירת מחדל - ואם המטרה שלכם היא להיות מומלצים, זה ירייה ברגל.
- להוסיף שורת Content-Signal. ההחלטה מה להתיר היא שלכם; העיקר שתהיה החלטה ולא שתיקה.
- לכתוב llms.txt. מי אתם, מה אתם מציעים, מה הגבולות. לכתוב אותו כמו שהייתם רוצים להיות מצוטטים.
- לוודא שהתוכן החשוב קיים כטקסט אמיתי בכתובת אמיתית. אם כל המידע שלכם חי בתוך אנימציות וג'אווהסקריפט, אין לסוכן מה לקרוא - וזה תיקון גדול יותר מכל השאר ביחד.
והמשפט שנשאר לי מהיום הזה: בעשור הקודם בנינו אתרים לשני קהלים - בני אדם וגוגל. עכשיו יש קהל שלישי, והוא היחיד שמגיע בלי עיניים. תדאגו שיהיה לו מה לקרוא.