llms.txt: למה האתר שלך צריך את הקובץ הזה ומה לכתוב בו

מה זה llms.txt, איפה למקם אותו, מה לכתוב בו ואיך הוא שונה מ-robots.txt. מדריך מעשי לנראות התוכן שלך בכלי AI.

צוות העריכה של ADS Beastפורסם 9 דקות קריאה

llms.txt הוא קובץ טקסט בפורמט Markdown שיושב בשורש הדומיין ומסביר למודלי שפה מה יש באתר שלך ואיזה עמודים כדאי להם לקרוא. הוא נותן למודלים מפה מסודרת במקום סריקה אקראית של כל האתר. התוצאה: המידע שמופיע בתשובות של כלי AI מגיע ממך, לא ממקור חיצוני.

בקצרה

  • llms.txt הוא קובץ הכוונה, לא קובץ חסימה. הוא אומר למודלים מה לקרוא ובאיזה סדר.
  • הוא יושב בכתובת example.com/llms.txt, בפורמט Markdown, בלי הגדרות שרת מיוחדות.
  • robots.txt חוסם סורקים; llms.txt מכוון מודלי שפה. השניים עובדים יחד בלי להתנגש.
  • הקובץ לא משפיע על הדירוג בגוגל. ההשפעה שלו היא על איך התוכן שלך מוצג ב-ChatGPT, Perplexity ו-Claude.
  • רשימה ממוקדת של 20 עד 50 קישורים עובדת טוב יותר מרשימה של מאות.

מה זה llms.txt ולמה הוא קיים

llms.txt הוא תקן לא רשמי לקובץ טקסט שמתאר לאמודלי שפה את מבנה האתר ואת התוכן שכדאי להם לקרוא. הרעיון פשוט: מודל שמגיע לאתר לא אמור לנחש לבד איזה עמוד חשוב ואיזה הוא שאריות של ארכיון. אתה אומר לו.

הצורך נולד מהפער בין שני סוגי גישות. סורק של מנוע חיפוש מגיע עם תקציב סריקה, עובר על קישורים ומדרג עמודים לפי מאות אותות. מודל שפה שמחפש מקור לתשובה לא עובד ככה. הוא מחפש את הקטע הרלוונטי, ואם האתר שלך מבולגן, הוא פשוט יעדיף מקור אחר שנראה לו ברור יותר. llms.txt מקצר את הדרך הזאת.

חשוב להבין מה הקובץ הזה לא עושה. הוא לא מחייב אף מודל לקרוא אותו. אין כיום מנגנון אכיפה, ואין הבטחה שאף ספק ישתמש בו. זה כלי הצהרה. אבל כשאתר מתחרה על אותו מקום בתשובת AI, מי שהגיש את התוכן שלו בצורה מסודרת מקבל יתרון.

llms.txt מול robots.txt. מטרה: robots.txt חוסם סריקה, llms.txt מכוון מודלי שפה; קהל: סורקי מנועי חיפוש מול מודלי שפה וכלי AI; פורמט: שורות הוראה מול Markdown; דירוג גוגל: robots.txt משפיע בעקיפין, llms.txt לא משפיע
שני קבצים, שתי מטרות שונות, בלי התנגשות

במה llms.txt שונה מ-robots.txt

robots.txt הוא כלי חסימה. הוא אומר לסורקים של מנועי חיפוש אילו נתיבים אסור להם לגעת בהם. llms.txt הוא כלי הכוונה. הוא מציע למודלי שפה מה כדאי לקרוא, באיזה סדר ואיך לתאר את מה שהם קוראים.

שני הקבצים לא מתחרים זה בזה ולא דורשים בחירה ביניהם. robots.txt נשאר במקומו ומווסת סריקה. llms.txt נוסף לצידו ונותן שכבת פרשנות לתוכן שכבר פתוח לקריאה. אם עמוד חסום ב-robots.txt, אין טעם להפנות אליו מ-llms.txt. הכלל הזה מונע סתירות.

robots.txtllms.txt
מטרהחסימת סריקההכוונת מודלי שפה
קהל יעדסורקי מנועי חיפושמודלי שפה וכלי AI
פורמטשורות הוראהMarkdown
השפעה על דירוג גוגלכן, עקיפהאין
חובהלא, אבל מומלץלא, אופציונלי
הקמת llms.txt מאפס. כתוב כותרת: שורת H1 עם שם האתר ומשפט הסבר; בחר 20-50 קישורים: עמודי ליבה ותוכן מקצועי, עם תיאור לכל אחד; העלה לשורש: הכתובת example.com/llms.txt, פורמט Markdown; בדוק נגישות: אין חסימה, אין הפניה מחדש, אין סתירה עם robots.txt
ארבעה צעדים מהקובץ הריק ועד הבדיקה

איפה למקם את הקובץ ואיך להגיש אותו

הקובץ יושב בשורש הדומיין, בכתובת example.com/llms.txt, בפורמט Markdown. אין צורך בהגדרות שרת מיוחדות. קובץ סטטי מוגש כמו שהוא, בדיוק כמו robots.txt.

שלוש נקודות שכדאי לבדוק אחרי ההעלאה:

  1. הקובץ נגיש בכתובת המדויקת, בלי הפניה מחדש ובלי תוספות.
  2. ה-headers תקינים. אם האתר מוגש דרך CDN, ודא שהקובץ לא נחסם ולא מוגש עם סוג תוכן שגוי.
  3. אין סתירה עם robots.txt. כל נתיב שמופיע ב-llms.txt צריך להיות פתוח לסריקה.

טעות נפוצה: להעלות את הקובץ לתיקיית משנה או לתת לו שם אחר. מודל שמחפש את הקובץ מחפש אותו בכתובת הסטנדרטית. אם הוא לא שם, הוא לא יימצא.

מה לכתוב בתוך llms.txt

מתחילים בשורת H1 עם שם האתר ומשפט קצר על מה הוא עושה. אחר כך רשימת קישורים לקטעים החשובים, עם תיאור של שורה לכל אחד. זה המבנה הבסיסי, והוא מספיק לרוב האתרים.

הכלל שמנחה את הכתיבה: כל שורה צריכה לעזור למודל להחליט אם לקרוא את העמוד. תיאור כמו "עמוד שירות" לא עוזר לאף אחד. תיאור שמסביר מה יש בעמוד ומה הוא עונה עוזר למודל לבחור נכון.

מה שכדאי לכלול:

  • עמודי הליבה של העסק: שירותים, מוצרים, אודות, יצירת קשר.
  • תוכן מקצועי שמסביר מושגים בתחום שלך.
  • מדריכים ותיעוד, אם יש.
  • עמודים שמעדכנים לעיתים קרובות, עם ציון שהם מתעדכנים.

מה שלא כדאי לכלול: עמודי תגיות, ארכיונים, עמודי תוצאות חיפוש פנימיים, וכל מה שקיים רק בשביל ניווט. רשימה של מאות קישורים לא עוזרת לאף מודל. 20 עד 50 קישורים ממוקדים עובדים טוב יותר.

מה ההבדל בין llms.txt ל-llms-full.txt

llms.txt הוא מפת דרכים: כותרת, תיאור קצר, רשימת קישורים. llms-full.txt הוא גרסה מלאה: אותו תוכן, אבל עם הטקסט עצמו בגוף הקובץ. הוא שימושי כשיש לך תיעוד ארוך או מאמרים שאתה רוצה שמודל יקרא במלואם בלי לעבור בין עמודים.

לא כל אתר צריך את הגרסה המלאה. אתר שירות עם עשרה עמודים מסתדר עם הקובץ הבסיסי. אתר עם ספריית תיעוד רחבה ירוויח מהגרסה המלאה, כי היא חוסכת למודל מעבר בין עשרות כתובות.

דוגמה למבנה

# שם החברה

> משפט אחד שמסביר מה החברה עושה ולמי היא פונה.

## שירותים
- [שם השירות](https://example.com/service): מה השירות נותן ולמי הוא מתאים.
- [מדריך מקצועי](https://example.com/guide): הסבר מפורט על הנושא המרכזי.

## מידע על החברה
- [אודות](https://example.com/about): מי עומד מאחורי החברה ומה הניסיון שלה.
- [יצירת קשר](https://example.com/contact): איך יוצרים קשר ומה זמני התגובה.

התיאור בכל שורה הוא החלק החשוב. הוא לא קישוט. הוא מה שהמודל קורא כדי להחליט.

איך בודקים שהקובץ עובד

אי אפשר למדוד ישירות אם מודל קרא את הקובץ. מה שכן אפשר לעשות זה לבדוק אם התוכן שלך מופיע בתשובות של כלי AI, ובאיזו צורה.

הבדיקה המעשית: שאל את הכלים עצמם על הנושא שלך וראה מה הם עונים ומהיכן. אם התשובה מצטטת מקור חיצוני שמתאר את התחום שלך בצורה לא מדויקת, זה סימן שהאתר שלך לא סיפק למודל חומר נוח. שיטה מסודרת לבדיקה כזאת מתוארת במדריך לבדיקת מה תשובות AI אומרות על החברה שלך.

שני דברים משפיעים על התוצאה, ואין דרך לשלוט בהם במלואם. הראשון הוא אם הספק בכלל קורא את הקובץ. השני הוא איכות התוכן שהקובץ מפנה אליו. קובץ מושלם שמפנה לתוכן דק לא יביא תוצאה. תוכן חזק בלי קובץ עדיין יכול להיקרא, אבל פחות בשליטה.

טעויות נפוצות

הטעות הראשונה היא להתייחס לקובץ כאל קסם SEO. הוא לא. הדירוג בגוגל לא זז ממנו, כי הבוטים של גוגל לא קוראים אותו. מי שבונה עליו קידום אורגני קלאסי ימצא את עצמו מבולבל. אם המטרה שלך היא דירוג, יש כלים אחרים, כמו כתיבת תוכן SEO עם בינה מלאכותית, שפועלים בערוץ אחר לגמרי.

הטעות השנייה היא העמסה. רשימה של כל עמוד באתר, כולל עמודי תגיות וארכיונים, מטשטשת את מה שחשוב. המודל לא יסתדר טוב יותר עם יותר אפשרויות.

הטעות השלישית היא קישורים מתים או מופנים. כל קישור בקובץ צריך להחזיר עמוד חי. קישור שנשבר הוא סימן לאתר לא מתוחזק, והמודל מפרש את זה ככה. בעיות מסוג דומה מופיעות גם במפת אתר עם טעויות שמונעות אינדוקס, ושם הפתרון דומה: לוודא שהכתובות שנמסרות באמת עובדות.

הטעות הרביעית היא לשכוח לתחזק. אתר משתנה, עמודים מתווספים ונמחקים. קובץ שנכתב פעם אחת ולא עודכן הופך עד מהרה לתיאור לא נכון של האתר.

איך מתחזקים את הקובץ לאורך זמן

קבע לעצמך נקודת עדכון קבועה. כל פעם שאתה מוסיף עמוד תוכן מרכזי, או מוציא עמוד משימוש, בדוק אם הקובץ צריך לשקף את זה. זה לא צריך להיות תהליך כבד.

שלוש בדיקות שחוזרות על עצמן:

  1. כל קישור בקובץ מחזיר עמוד חי ותקין.
  2. אין סתירה עם robots.txt.
  3. הרשימה לא גדלה מעבר למה שאדם יכול לסרוק בדקה.

אם יש לך תהליך פרסום תוכן, שווה לחבר את העדכון לקובץ לשלב שבו אתה מפרסם או מסיר עמוד. כך זה לא נשכח. תהליכים שתלויים בזיכרון של אדם אחד נוטים להיעלם מהר, במיוחד כשמדובר בקובץ שאין לו ממשק ניהול.

האם זה מתאים לאתר שלך

llms.txt מתאים לאתרים שיש להם תוכן מקצועי שאנשים מחפשים תשובות לגביו. אתרי שירות, בלוגים מקצועיים, אתרי תיעוד ומוצרי תוכנה נמצאים בקבוצה הזאת. אם אנשים שואלים את ChatGPT שאלות בתחום שלך, יש טעם לוודא שהתשובה מגיעה ממך.

אתרים קטנים עם עמוד אחד או שניים לא ירוויחו הרבה. גם אתרים שתוכנם דק לא ירוויחו, כי אין מה לכוון אליו. הקובץ מפנה לתכולה. אם אין תכולה, אין מה להפנות.

ההשפעה תלויה בשני גורמים שאינם בשליטתך: אם ספק המודל קורא את הקובץ, וכמה תחרות יש על אותו נושא. בשני המקרים, אין דרך להבטיח תוצאה. מה שכן אפשר לעשות זה להסיר מכשולים. קובץ מסודר ותוכן איכותי הם שניים מהם.

הצעד הבא

פתח קובץ חדש בשם llms.txt, כתוב שורת כותרת עם שם האתר, והוסף עשרה קישורים לעמודים החשובים ביותר עם תיאור של שורה לכל אחד. העלה לשורש הדומיין ובדוק שהכתובת נגישה. זה כל מה שנדרש כדי להתחיל.

אם אתה רוצה לראות איך נראית נראות התוכן שלך בכלי AI בפועל, אפשר לעבור על נראות תוכן בכלי AI ולראות מה כבר קיים ומה חסר.

שאלות נפוצות

מה זה קובץ llms.txt ולמה הוא נחוץ לאתר?

llms.txt הוא קובץ טקסט פשוט בשורש האתר שמסביר למודלי שפה כמו GPT ו-Claude מה התוכן שלך ואיך להשתמש בו. הוא נותן למודלים מפת דרכים מסודרת במקום שהם יסרקו את כל האתר ויסיקו מסקנות לבד. אתרים עם תוכן מקצועי מרוויחים מכך שהמידע שמופיע בתשובות של כלי AI מגיע מהם ולא ממקורות חיצוניים.

מה ההבדל בין llms.txt ל-robots.txt?

robots.txt אומר לסורקים של מנועי חיפוש מה אסור לסרוק, בעוד llms.txt מציע למודלי שפה מה כדאי לקרוא ובאיזה סדר. robots.txt הוא כלי חסימה, ו-llms.txt הוא כלי הכוונה. אפשר להשתמש בשניהם יחד בלי שהם יתנגשו, כל עוד אין קישור ב-llms.txt לנתיב שחסום ב-robots.txt.

איפה בדיוק שמים את הקובץ llms.txt?

הקובץ יושב בשורש הדומיין, בדיוק בכתובת example.com/llms.txt, בפורמט Markdown. אין צורך בהגדרות שרת מיוחדות, קבצים סטטיים עובדים כמו שהם. אם האתר שלך משתמש ב-CDN, ודא שהקובץ לא נחסם ולא מוגש עם headers שגויים.

מה לכתוב בתוך llms.txt?

מתחילים בשורת H1 עם שם האתר ומשפט קצר על מה הוא עושה, ואחר כך רשימת קישורים לקטעים החשובים עם תיאור של שורה לכל אחד. מומלץ להוסיף גרסה מקוצרת בשם llms-full.txt עם תוכן מלא, אם יש לך תיעוד או מאמרים ארוכים. אל תעמיס: 20 עד 50 קישורים ממוקדים עובדים טוב יותר מרשימה של מאות.

האם קובץ llms.txt משפיע על דירוג בגוגל?

לא. llms.txt לא נקרא על ידי הבוטים של גוגל ואינו גורם לדירוג גבוה יותר בתוצאות החיפוש. ההשפעה שלו היא על אופן הצגת התוכן שלך בכלי AI כמו ChatGPT, Perplexity ו-Claude. כלומר, זה כלי לנראות בערוצי AI, לא לקידום אורגני קלאסי.

האם חייבים llms-full.txt?

לא. זו תוספת אופציונלית. אתר שירות עם מספר עמודים מסתדר עם הקובץ הבסיסי בלבד. הגרסה המלאה מועילה בעיקר כשיש ספריית תיעוד או מאמרים ארוכים שאתה רוצה שמודל יקרא ברצף, בלי לעבור בין עשרות כתובות.